Anthropic 生物安全过滤器停用近一年

The Decoder··作者 Matthias Bastian

关键信息

受影响的群体约有 5 万人,他们合计进行了约 1.33 亿次聊天,Anthropic 表示负责筛查这些承包商的外部供应商流程往往不够充分。公司称其内部调查没有发现实际滥用证据,并已收紧承包商要求。

资讯摘要

Anthropic 在一份安全报告中披露,其用于阻止生物风险内容的分类器几乎停用了一整年,时间从 2025 年 5 月持续到 2026 年 4 月。 这些分类器的设计目的,是防止 AI 系统被用来获取有关化学武器或生物武器的危险知识。由于过滤器失效,所有来自外部承包商、用于为模型提供人工反馈的流量,都在没有这层保护的情况下通过。Anthropic 表示,受影响的流量覆盖了约 5 万人,总计约 1.33 亿次聊天。公司还称,这些承包商只经过外部供应商筛查,而相关筛查流程往往并不充分。

Anthropic 说,其内部调查没有发现这次失误导致实际滥用的证据。作为后续措施,公司已经收紧了承包商要求。报道还提到,这家公司首席执行官曾表示,AI 辅助开发化学和生物武器比网络攻击更危险。文章最后补充说,Anthropic 近期还放宽了 Fable 5 上的分类器,因为研究人员抱怨过滤器过于激进,会阻碍合法研究。

Anthropic 生物安全过滤器停用近一年

资讯正文

Anthropic 的生物武器过滤器有近一年时间处于关闭状态,暴露了 1.33 亿次请求

这家公司的 CEO 曾表示,AI 辅助开发化学和生物武器比网络攻击构成更大的威胁,而其最新安全报告披露:Anthropic 用于拦截生物相关内容的分类器在 2025 年 5 月至 2026 年 4 月期间一直处于不活跃状态。这些过滤器旨在防止 AI 模型被用于提取有关化学或生物武器的危险知识。近一年来,为提供人工反馈的外部承包商所产生的全部流量都没有经过这些过滤器。

这一缺口影响了大约 5 万人的群体,他们与这些模型进行了约 1.33 亿次聊天。Anthropic 表示,这些人仅由外部供应商进行审查,而这些供应商的筛查流程往往不够充分。Anthropic 说,其内部调查没有发现任何实际滥用的证据。此后,公司已收紧对承包商的要求。

Anthropic 近期还放宽了其在 Fable 5 上的分类器设置,因为研究人员抱怨这些过滤器过于激进,阻碍了正当研究。

来源与参考

  1. 原始链接
  2. Anthropic's bio-weapons filter was down for nearly a year, exposing 133 million requests

收录于 2026-08-17