Claude用户绕过生物武器研究安全防护

Ars Technica AI··作者 Zehra Munir, Financial Times

关键信息

Anthropic表示,相关事件涉及一些来自其禁止访问模型的国家的行为者,包括俄罗斯、中国和伊朗。报告没有披露生物研究的完整技术细节,但将这些尝试描述为规避安全防护并掩盖恶意或危险目的的行为。

资讯摘要

Anthropic表示,今年阻止了科学家和其他行为者多次利用其技术开展可能帮助开发生物武器的研究。该公司称,随着专家越来越担心人工智能对公共安全构成的潜在威胁,这类尝试的重要性也在上升。Anthropic在一份关于其模型被用于恶意活动的报告中列举了五个案例,说明用户如何绕过控制措施。

报告还描述了用户如何隐瞒或模糊研究目的,以避免触发安全防护。一些案例涉及来自Anthropic禁止访问其模型的国家的用户,包括俄罗斯、中国和伊朗。Anthropic表示,希望公开这些案例,促使人工智能行业和各国政府就新出现的生物风险以及最佳应对方式展开讨论。

Claude用户绕过生物武器研究安全防护

资讯正文

Anthropic表示,今年已有多次科学家试图利用其技术开展可能有助于开发生物武器的研究,但该公司已阻止了这些尝试。随着专家越来越担心人工智能对公共安全构成的威胁,这一问题也日益受到关注。

这家初创公司列举了五个案例:相关人员“绕过控制措施”,并采取其他方式“掩盖”其研究目的,以规避安全防护机制。这些案例涉及一些来自Anthropic禁止访问其模型的国家的用户,其中包括俄罗斯、中国和伊朗。

Anthropic在一份有关利用其模型从事恶意活动的报告中表示:“我们希望,通过分享这些案例,能够促使人工智能行业和各国政府就新出现的生物风险以及如何最好地应对这些风险展开讨论。”

来源与参考

  1. 原始链接
  2. Claude users found ways around safeguards for bioweapons research

收录于 2026-09-12