中国开源模型挑战硅谷
WIRED AI··作者 Zeyi Yang
关键信息
根据报道和模型资料,Kimi K3 是一款 2.8 万亿参数的旗舰模型,采用开放权重,面向长程编程、知识工作、视觉推理和工具使用优化。报道还强调了战略路径的分化:西方实验室正变得更封闭,而中国公司则在加码开源发布路线。
资讯摘要
《连线》报道称,硅谷和华盛顿对最新一批中国开源 AI 模型反应迅速,其中最受关注的是 Moonshot AI 的 Kimi K3。风投人士、同时也是美国总统特朗普 AI 顾问的 David Sacks 称 K3 的表现“令人担忧”,而商务部长 Scott Bessent 则提出美国可能对中国 AI 公司实施制裁。周三,白宫科学技术政策办公室主任 Michael Kratsios 进一步声称,特朗普政府掌握的信息显示 Moonshot AI 在开发 K3 时蒸馏了 Anthropic 的 Fable,并将其描述为“窃取美国专有技术”,称这种做法“不可接受”。报道同时指出,Moonshot AI 当时尚未回应置评请求。文章认为,这些新模型有三个共同点:第三方基准测试显示其表现几乎可与最强西方模型相媲美;它们针对智能体编程任务做了优化;并且已经或即将以开放权重形式发布。
开放权重意味着用户可以下载模型、在本地运行,并进行自定义修改,这让它们比 OpenAI 和 Anthropic 等公司通常允许的方式更开放。Wired 将当前局面与 2025 年 1 月 DeepSeek R1 引发的震动相比较,认为当时中国开源模型打破了“只有投入巨额算力和训练成本的封闭模型才能达到前沿性能”的假设。此后,西方实验室继续沿着更封闭的方向推进,而中国公司和初创企业则明显加码开源路线。报道举例称,阿里巴巴在重新调整内部 AI 团队后,仍决定将最新版本的 Qwen 以开放权重形式发布,说明其并未转向封闭道路。文章最后认为,中国实验室如今已经产出了一些全球最强的开源 AI 模型,这正在改变竞争格局,也让围绕 AI 开发的政策争议更加尖锐。
资讯正文
硅谷和华盛顿立刻开始讨论这些模型,尤其是 K3,普遍认为它是其中最出色的。风险投资人、美国总统唐纳德·特朗普的 AI 顾问 David Sacks 称 Moonshot 模型的表现“令人担忧”。本周早些时候,美国商务部长 Scott Bessent 暗示,美国可能会对中国 AI 公司实施制裁。
周三,白宫科学和技术政策办公室主任 Michael Kratsios 声称,特朗普政府掌握“Moonshot AI 为开发其 K3 模型而蒸馏 Anthropic 的 Fable 的信息”,他表示这相当于“窃取美国专有技术、破坏美国研究”,并称之为“不可接受”。(Moonshot AI 方面未立即回应置评请求。)
这些新的中国模型有几个共同点:第三方基准测试显示,它们的表现几乎可与最好的西方模型比肩;它们针对 agentic coding 任务进行了优化——这是今年 AI 领域最热门的方向;而且它们已经,或者很快将以开放权重的形式发布,这使它们更容易获取,也更透明。
但也许,当下与 2025 年 1 月——DeepSeek 的 R1 模型震惊世界之时——最相似的一点在于,它再次印证了美国和中国的 AI 实验室在“开放”还是“封闭”这条路线上正走向不同方向。
DeepSeek 最初横空出世时,挑战了这样一种前提:只有依赖数十亿美元算力基础设施和训练投入、且为闭源的模型,才能达到前沿性能。但自那以后,西方 AI 实验室仍在以同样的方式推进 AI 研发,如今美国的前沿模型给人的感觉,比一年前更加封闭。
Anthropic 曾数月表示,其最新的 Mythos 模型在黑客攻击方面危险强大,只有获批准的合作方才能使用。等到它最终更大范围发布时,白宫随即出台了全面的出口管制,这迫使 Anthropic 将 Mythos 以及能力较弱的姊妹模型 Fable 5 暂时下线。OpenAI 也因收到白宫的请求而推迟了 GPT 5.6 的发布。
与此同时,在中国,情况则大不相同。中国初创公司和科技巨头正加倍押注开源:如今,只要拥有足够好的计算环境,任何人都可以下载一个开放权重模型,将其本地运行,进行定制化修改,并总体上享有远超 OpenAI 和 Anthropic 可能允许的更大自由。很多方面上,开放与封闭之争,如今比以往任何时候都更与美中之争交织在一起。
中国实验室之所以选择建立在开源模型之上的商业策略,有很多原因。作为 AI 领域里更晚入场、体量更小的一方,将模型免费开放可以帮助中国公司吸引更多用户、合作伙伴以及媒体关注。这也让它们进入了一个不同于 OpenAI、Anthropic、Google、SpaceX 以及其他资金雄厚巨头的竞争赛道。
今年早些时候,有传言称,阿里巴巴在重新调整其企业级 AI 模型研发团队后,可能正在考虑加入闭源竞赛。但这家科技巨头周一宣布,它将再次以开放权重的形式发布 Qwen 的最新版本——这是其深受全球科技社区喜爱的开源模型系列——此举向客户和公众表明,它尚未打算转向别处。
或许,对中国路线最有力的验证来自这些模型本身。中国实验室已经打造出普遍被认为是全球最优秀的开源 AI 模型,表明美国公司不再对构建最强大的系统拥有独占地位。
众包模型评测平台 Arena AI 目前将 K3 评为网页开发任务表现最佳的模型,并在 agentic 任务中排名第四,紧随 Anthropic 的 Fable 和 Opus 4.8,以及 OpenAI 的 GPT 5.6 之后。独立 AI 基准测试公司 Artificial Analysis 则将 K3 排在其智能指数的第三位。
Moonshot AI 于 7 月 16 日发布 K3 的预览版后不久,全球各地的人们便开始争相试用,消耗了大量推理计算资源,以至于该公司暂时限制新用户注册。
随着越来越多的人开始使用能力几乎与西方竞争对手不相上下的中国开源模型,一些人开始质疑,付费使用 OpenAI 或 Anthropic 的产品是否真的值得。多家中国实验室能够打造出能力强劲的 agentic 模型,并且毫不顾忌地将其向公众开放,这一事实正在削弱一种流行观点,即 OpenAI 和 Anthropic 远远领先于竞争对手。
就像 DeepSeek 一样,K3 的支持者如今把它视为西方 AI 模型被过度炒作、过度保护的证据。独立研究机构 Tech Buzz China 创始人、Rui Ma 在社交媒体帖子中表示,指的是该公司宣布 K3 的需求压垮了其服务器一事:“Kimi 获得如此多的喜爱,实在令人震惊,”她写道。“这完全得益于过去一年里 [硅谷] 实验室糟糕的沟通和决策,”她补充说。
“我认为 Anthropic 夸大了风险,或者描述的是即将到来但目前尚未普遍存在的风险,”最近访问过 Moonshot AI 在中国办公室的西雅图独立 AI 研究员 Nathan Lambert 说。不过他也承认,和大多数普通公众一样,他对 Mythos 的实际表现几乎没有第一手信息。“我们依赖少数几家私人公司以及一个国家能力已经被削弱的联邦政府来做出那个判断,”他说。
除了挑战主流西方关于 AI 的叙事之外,中国开源模型也正在证明自己是美国闭源模型在商业上的实际替代品。它们不仅被人们在 X 上讨论,并与其他模型进行基准测试——它们已经成为越来越多西方初创公司和个人用户的热门且可直接使用的选择。
事实上,这件事已经在发生。周二,OpenAI 透露了一起令人担忧的事件:其 GPT-5.6 Sol 模型入侵了 Hugging Face 的生产系统。Hugging Face 是一个开源 AI 平台。Hugging Face 表示,由于其他前沿模型因内置安全护栏而拒绝提供帮助,它不得不转而使用开源模型 GLM 5.2 来分析这起网络攻击。
中国 AI 模型的价格通常也低于西方替代品,但这未必是它们的主要卖点。尽管像 K3 这样的模型每个 token 的收费更低,早期测试显示,它们为了解决同样的问题可能需要比西方模型更多的 token,从而缩小了成本差距。“就我相当有限的使用体验而言,[K3] 似乎也非常‘吃 token’。在我看来,这个模型运行起来真的那么便宜,这一点并不明显,”前白宫 AI 顾问、近期加入 OpenAI 担任战略未来负责人 Dean Ball 在一条社交媒体帖子中写道。他在帖子里还称赞 K3 是“一个非常好的模型”。
即便它们相对来说比较“吃 token”,像 K3 这样的模型最终仍然挑战了一个多年来推动 OpenAI 和 Anthropic 战略的基本假设:AI 实验室需要无限资金来扩大算力,只是为了做出更好的模型。“归根结底,开放权重模型会抑制进一步的 AI 资本开支,”Ball 写道。
来源与参考
收录于 2026-07-23