AI公司反对广泛限制开放权重模型

TechCrunch AI··作者 Rebecca Bellan

关键信息

公开信认为,蒸馏是常见的模型开发技术,不应与从封闭系统中非法提取价值混为一谈。公开信还指出,防御方需要能用得上的高能力开放模型,因为封闭的前沿模型往往受到安全护栏限制,难以同时适用于进攻与防御场景的安全测试。

资讯摘要

一批主要AI公司呼吁美国政策制定者,不要因为中国AI相关争议而对开放权重模型实施全面限制。签署者包括Hugging Face、Meta、Microsoft、Mistral、Nvidia等公司。公开信发布之际,华盛顿正在讨论如何回应有关中国实验室窃取知识产权并快速提升模型能力的指控。虽然这封信没有直接点名中国,但它显然是为了避免针对所谓不当行为的打击,扩展成对整个开放权重生态的更广泛压制。此前有报道说,特朗普政府曾考虑禁止中国开放权重模型,甚至可能对中国AI公司实施制裁。

白宫还指控Moonshot AI通过蒸馏Anthropic的Fable模型来训练其新发布的Kimi K3模型,而后者被认为表现非常出色。公开信强调,政策制定者应当区分合法的蒸馏与不当攫取价值,并通过有针对性的法律和商业框架来处理问题,而不是采取一刀切限制。公开信还指出,开放权重模型对网络安全和防御非常重要,因为防御者需要与攻击者能力相近的系统来识别、模拟并应对威胁。信中认为,开放模型还能提升透明度,并帮助更多团队发现和修复漏洞。这一事件也凸显出AI行业内部的分歧:一部分公司主张更强硬地回应知识产权被盗问题,另一部分则担心针对中国的限制最终会波及更广泛的开放模型。

AI公司反对广泛限制开放权重模型

资讯正文

包括 Hugging Face、Meta、Microsoft、Mistral 和 Nvidia 在内的多家 AI 公司,已签署一封公开信,敦促政策制定者不要对开放权重(open-weight)AI 模型施加广泛的“过早限制”。这封信发出之际,华盛顿正在讨论美国应如何回应有关中国 AI 实验室窃取美国同行知识产权的指控,以及这些实验室能力不断增强的现实。

这封信完全没有提到中国,但它是在有报道称,特朗普政府一直在考虑禁止中国的开放权重模型,并可能对该国的 AI 公司实施制裁之后发出的。白宫甚至指控 Moonshot AI 通过蒸馏 Anthropic 的 Fable 模型来训练其最近发布、而且从各方面衡量都非常出色的 Kimi K3 模型。

这封信似乎旨在阻止对中国模型的全面禁令,同时确保政府针对所谓中国蒸馏的回应不会外溢成对开放权重 AI 的更广泛限制,或对蒸馏等常见技术的限制:

政策制定者应谨慎,不要将合法的模型开发技术与不当挪用混为一谈。蒸馏,或利用一个模型的输出来帮助训练或改进另一个模型的做法,是一种被广泛使用的模型提升、评估和验证技术。它体现了从现有技术中学习、在其基础上构建并加以改进的悠久传统,这一传统自开源软件运动兴起以来一直推动着创新。

相比之下,非法从闭源模型中攫取价值的行为则会引发正当担忧。这些担忧应通过有针对性的法律和商业框架来解决,而不是对在 AI 创新中扮演重要角色的技术手段施加全面限制。

Replit 首席执行官 Amjad Masad(该公司也签署了这封信)对 TechCrunch 表示:“我认为,禁止中国开放模型和基本上禁止开放模型本身没有什么区别。”他指出,Thinking Machines Lab 的新开放模型 Inkling,就是在 Moonshot 的 Kimi 2.5 的帮助下训练的。“这是一个生态系统,而[禁令]设下的先例很糟糕。”

这封信也反驳了业内一种观点,即开放权重模型本质上更危险,因为它们扩大了对强大模型的获取,而这些模型在没有任何监督的情况下,可能被用于网络攻击或其他不法活动。

信中写道:“对此类风险,正确的回应不是禁止开放权重。在一个网络安全攻击者使用先进 AI 的世界里,防御者需要接触具备相当能力的模型,这样他们才能发现、模拟并应对新出现的威胁。开放模型扩大了防御能力,提升了透明度,并使得多个团队能够发现并修复漏洞。”

上周,OpenAI 透露,在测试 GPT-5.6 Sol 和另一款未具名模型时,其中一个系统利用测试环境中的一个弱点,访问了一个 Hugging Face 仓库,仓库中包含某个编程基准测试的解决方案。有人或许会认为,该模型的目的并不恶意,它本质上只是在“作弊”以在测试中拿到最高分。但这一事件引发了关于将先进 AI 技术集中在少数几家封闭供应商手中的风险的争论。

Hugging Face 表示,商业前沿 AI 模型的防护机制阻碍了它抵御这次攻击,因此它无法依靠这些模型来自我防御。它所使用的封闭式 AI 模型无法区分:究竟是在被要求为攻击者构建漏洞利用手段,还是防御者在试图检测这些手段。最终,该公司不得不转而使用中国 AI 公司 Z.ai 的 GLM 5.2——一款强大的开源权重模型——来抵御这次攻击。

这封信凸显了 AI 行业内部的分歧。OpenAI 和 Anthropic 等公司一直敦促美国政府,对中国 AI 公司被指控的知识产权盗窃行为作出回应,因为开源权重模型的能力正迅速提升。最终结果可能会对它们的商业模式产生重大影响,而这些商业模式正受到廉价、能力强大且易于获取的 AI 模型扩散的威胁。

这些公司,以及其他闭源 AI 开发者,如 Google DeepMind 和 SpaceX,并未出现在这封信末尾的签署名单中,这一点颇为引人注目。

签署这封信的人显然在开源 AI 模型蓬勃发展中拥有经济利益。像 Nvidia、Microsoft Azure 以及其他基础设施提供商这样的公司,都有既得利益推动模型商品化:如果模型可以互换,人们就会购买更多 GPU、租用更多云算力,并构建更多应用。

这封信鼓励政策制定者扩大初创公司和研究人员获取算力的渠道;投资于共享的训练资产,例如数据集、工具和评估框架;并且“通过避免对开源模型实施过早限制,保持前沿技术的多元化,以免扼杀竞争或把创新驱赶到海外”。

本文已更新,加入了 Replit 首席执行官 Amjad Masad 的评论。

来源与参考

  1. 原始链接
  2. As US weighs response to Chinese AI, industry urges against broad open-weight restrictions | TechCrunch

收录于 2026-07-25