Anthropic生物安全过滤器停用近一年
The Decoder··作者 Matthias Bastian
关键信息
Anthropic表示,受影响的承包商由外部供应商进行审核,但这些筛查流程往往不够充分,公司内部调查没有发现实际滥用的证据。此后,Anthropic已经收紧了承包商要求;此外,公司最近还放宽了Fable 5上过于激进的分类器,因为研究人员称这些过滤器会阻挡合法的生物学研究。
资讯摘要
Anthropic披露,其一套生物安全防护措施在近一年的时间里处于失效状态,时间跨度为2025年5月至2026年4月。被停用的是用于拦截危险生物学信息的生物分类器,目的是防止用户借助模型获取化学或生物武器相关的敏感知识。在这段期间,外部承包商提供人工反馈的所有流量都没有经过这些过滤器。Anthropic表示,这一缺口影响了大约5万人,以及约1.33亿次聊天请求。
公司称这些承包商虽然经过外部供应商筛查,但相关审核往往不够严格。Anthropic还表示,内部调查没有发现该漏洞被实际滥用的证据。发现问题后,公司已经收紧了承包商的准入要求。这一披露尤其引人注目,因为Anthropic高管曾公开表示,AI辅助开发化学和生物武器的威胁比网络攻击更大,因此这次事件属于高敏感领域安全护栏的直接失效。

资讯正文
Anthropic 的生物武器过滤器有近一年时间处于关闭状态,暴露了 1.33 亿次请求
这家公司的 CEO 曾表示,AI 辅助开发化学和生物武器比网络攻击构成更大的威胁,而其最新安全报告披露:Anthropic 用于拦截生物相关内容的分类器在 2025 年 5 月至 2026 年 4 月期间一直处于不活跃状态。这些过滤器旨在防止 AI 模型被用于提取有关化学或生物武器的危险知识。近一年来,为提供人工反馈的外部承包商所产生的全部流量都没有经过这些过滤器。
这一缺口影响了大约 5 万人的群体,他们与这些模型进行了约 1.33 亿次聊天。Anthropic 表示,这些人仅由外部供应商进行审查,而这些供应商的筛查流程往往不够充分。Anthropic 说,其内部调查没有发现任何实际滥用的证据。此后,公司已收紧对承包商的要求。
Anthropic 近期还放宽了其在 Fable 5 上的分类器设置,因为研究人员抱怨这些过滤器过于激进,阻碍了正当研究。
来源与参考