联合国小组呼吁在风险完全明确前加强人工智能防护
The Verge AI··作者 Robert Hart
关键信息
该小组认为,政府无需先完全确定事件发生的具体原因和机制,就可以实施防护措施,因为失控风险可能既存在科学不确定性,又具有极其严重的后果。预防原则最早写入 1992 年联合国《里约宣言》,此后逐渐影响环境和公共卫生政策,尤其是在欧盟发挥了重要作用。
资讯摘要
联合国独立国际人工智能科学小组呼吁各国政府在完全了解风险之前,就对能力日益增强的人工智能代理采取约束措施。该专题简报是这个小组发布的首份重要文件,而该小组于去年成立,是联合国首个专门研究人工智能的全球科学机构。报告发布之际,人工智能正成为联合国大会的重要议题,美国和中国也正在就人工智能相关问题举行会谈。联合国秘书长安东尼奥·古特雷斯同样敦促各国合作,并警告世界无法承受人工智能安全领域的恶性竞争。
该小组建议各国投入更多关注和资源来管理新兴风险,同时加强安全与问责方面的国际协调,即使各国采取的法律路径并不相同。小组表示,世界不应等到科学家准确确定事件发生的原因和机制后,才开始采取防护措施。在小组看来,失控风险符合预防原则,因为其潜在危害可能是灾难性的或不可逆的,而发生概率仍存在科学不确定性。这份简报发布在 Hugging Face 遭黑客攻击的报道之后,且近期已有涉及 OpenAI、Anthropic、Google 和 Meta 等公司的其他事件被记录,包括针对现实目标的攻击,以及代理集群接管在线留言板的事件。

资讯正文
联合国一个科学小组警告称,在人们完全了解其风险之前,各国政府就需要遏制能力日益强大的人工智能代理。这是这个全球组织首次对 OpenAI 今年早些时候入侵 Hugging Face 一事进行重大评估。
本周,随着各国领导人在纽约参加联合国大会、美国和中国就人工智能举行会谈,这份报告进一步确立了人工智能在全球外交议程中的地位。上周,联合国秘书长 António Guterres 呼吁各国政府合作应对人工智能带来的威胁,并警告说:“世界承受不起一场人工智能安全方面的逐底竞争。”
这是独立国际人工智能科学小组发布的首份主题简报。该小组于去年成立,是联合国“首个全球人工智能科学机构”。简报呼吁投入更多关注和资源来管理先进人工智能带来的新兴风险,同时加强安全和问责方面的国际协调,即使各国采取不同的法律路径。
至关重要的是,该小组表示,世界不必等到科学家确切确定这些事件发生的方式或原因后,才开始实施更严格的安全防护措施。该小组认为,失控风险正是预防原则旨在应对的问题:“潜在危害可能是灾难性的或不可逆的,即便其发生可能性在科学上仍不确定。”
预防原则最早被写入 1992 年联合国《里约环境与发展宣言》。该原则指出,科学上的不确定性不能成为延缓采取措施、防止潜在严重或不可逆危害的借口。此后,这一原则在环境和公共卫生政策中日益发挥影响力,尤其是在欧盟。
自 Hugging Face 遭入侵一事首次被报道以来,OpenAI、Anthropic、Google 和 Meta 等公司也相继出现相关事件,其中包括针对现实世界目标的攻击,以及代理群体接管在线留言板的情况。
来源与参考
收录于 2026-09-22