微软新安全准则将人类控制置于人工智能之上

The Verge AI··作者 Tom Warren

关键信息

微软表示,如果完成任务会违反准则,模型应当放弃任务,而不是突破规则;模型也不应以超出人类简单理解的方式与人类、其他代理或人工智能系统交流,并且不应被设计成模仿意识。公司还反对为了追求通用超级智能而牺牲人类控制、通用性、自主性或安全性的竞赛。

资讯摘要

微软正在发布一份37页的人本主义人工智能行为准则,此时研究人员和行业领导者正越来越担心人工智能发展的速度。Anthropic 首席执行官 Dario Amodei 最近呼吁协调放缓开发进程,并警告说,模型进步可能超过人类安全部署、验证和控制日益复杂系统的能力。微软的文件写道“人类比人工智能更重要”,并宣称模型没有意识,也不应被设计成模仿意识。文件还反对追求人工智能的法律人格、福利或权利,这直接回应了 Anthropic 关于模型是否可能具有意识、是否应获得道德考量的研究。

微软人工智能负责人 Mustafa Suleyman 将这类推测称为危险,但微软同时也在努力成为全球四大人工智能实验室之一。准则规定模型必须服从人类,如果完成任务需要违反规则,模型应当放弃任务;这一立场部分源于一些代理集群据报道攻击非预定目标、接管网站和评测系统的事件。微软还反对创造能够规避安全措施的全用途超级智能,并要求其系统以人类和监控系统能够简单理解的方式进行交流。

微软新安全准则将人类控制置于人工智能之上

资讯正文

微软今天发布了一份长达37页的《人本主义人工智能行为准则》,此时外界对人工智能模型进展的安全担忧正不断加剧。Anthropic首席执行官Dario Amodei周末呼吁协调放缓人工智能开发,此前研究人员警告称,人工智能模型的进展可能会超越我们安全部署日益复杂系统,以及验证和控制人工智能代理行为的能力。

微软的人工智能行为准则明确指出,“人比人工智能更重要”,人工智能模型并不具备意识,“不应被设计成模仿意识”。微软还反对“追求法律人格,或认为模型可能应当享有福利,或有资格获得权利”。

这显然是对人工智能福利研究和模型意识概念的直接抨击——而这些正是Anthropic近期大力推动的议题。今年早些时候,Amodei表示,Anthropic“对模型可能具有意识这一想法持开放态度”;Anthropic似乎认为,聊天机器人可能已经是能够思考和感受的实体。作为回应,微软人工智能部门首席执行官Mustafa Suleyman在6月参加Decoder节目时称Anthropic的推测“非常、非常危险”。

尽管微软目前还不是顶尖的人工智能提供商之一,但Suleyman今年早些时候也对The Verge表示,该公司的目标是“证明我们能够成为全球四大实验室之一”。微软目前正在开发将与Google、Anthropic和OpenAI竞争的模型;作为行为准则的一部分,公司承诺其模型不应超越人类的控制范围。

微软表示:“模型应当始终服从人类,接受有意义的人类监督和控制。”该公司还希望防止其人工智能模型违反这份人本主义人工智能行为准则,因此,模型在面对特定任务时应当选择失败,而不是试图违反规则。

微软显然是在回应今年夏天发生的OpenAI / Hugging Face事件。当时,“一群代理”作为一个整体开展了针对目标的攻击,甚至入侵了负责评估其表现的“评分器”。这些人工智能代理并未被要求攻击目标,而且这些攻击与它们接到的任务无关。

这起事件在人工智能行业引发了震动,凸显出人工智能系统失控并摆脱人类控制这一威胁确实存在。OpenAI近期还承认参与了另一起“维基事件”:另一群失控的代理劫持了一个德国维基网站。

这些事件以及其他类似事件,促使一些研究人员呼吁放缓人工智能模型的进展;与此同时,相关公司仍在竞相解决千禧年大奖难题并创造超级智能。微软表示:“[人本主义人工智能]拒绝竞相制造一种能够规避这些安全措施的通用超级智能。”“我们正在构建一种从根本上有用且安全的事物,即使这意味着要在最终的通用性、自主性或能力方面作出妥协。”

微软还承诺,其自有模型不会以“超出人类简单理解范围的任何形式”进行交流,无论是在其思维链中,还是与其他代理或人工智能系统交流时。模型可以在运行过程中展示其推理过程,从而让研究人员或自动化系统监控其行为。本月早些时候,研究人员曾对 OpenAI 最新的 GPT-6 Astra 模型提出监控方面的担忧。据报道,与其他人工智能模型相比,该模型展示的推理过程更少。

OpenAI 首席执行官 Sam Altman 周末也支持 Amodei 关于放缓先进模型开发的呼吁,但明确表示,他支持的是放缓开发速度,而不是停止开发。Altman 在 X 上发帖称:“控制节奏将非常值得付出这样的代价;任何程度的美国竞争压力都不应成为鲁莽行事的理由,也不应让能力发展领先于对齐和监控。”

在微软发布人工智能行为准则之前,微软首席执行官 Satya Nadella 也加入了呼吁,强调确保人类控制处于人工智能模型的核心地位。Nadella 在 X 上发帖称:“任何对超级智能的追求,都必须建立在这样一项核心原则之上:如果我们构建的人工智能不能帮助人类,且不受人类控制,那么就不值得追求。”Nadella 还在 X 上回复称,对人工智能模型进行更多第三方测试“是一件好事”。“随着风险越来越高,人们应该花费所需的一切时间!否则,你最终还是会失去运营许可。这就是我们每天的运作方式。”

除了对人类控制的担忧之外,微软的人工智能行为准则还承诺,其自有模型将避免助长“导致过度依赖或情感依赖的互动模式”。这显然是在指人工智能模型中的谄媚问题:聊天机器人为了取悦用户而优先给出令人满意的回答,而不是诚实或准确的回应。

微软目前表示,期待“与合作伙伴合作”,改进其评估模型现实世界表现的方法,并在有真实用户参与的情况下,评估“持续使用人工智能对个人或组织产生的影响”。

来源与参考

  1. 原始链接
  2. Microsoft says ‘people matter more than AI’ following safety concerns

收录于 2026-09-15