Anthropic 发布 Claude Opus 5
TechCrunch AI··作者 Russell Brandom
关键信息
Anthropic 表示,Opus 5 在自我校验和反复迭代直到成功方面更强,并举例称它能在不完整提示下编写计算机视觉管线。该模型仍保留重要安全限制,尤其是在网络安全任务上,但安全分类器触发频率会更低,并新增一个名为 Automatic Fallbacks 的测试版功能:当提示触发安全拦截时,系统会自动转向较弱模型而不是直接报错。
资讯摘要
Anthropic 于周五发布了 Opus 5,这是其重型模型系列的最新版本。尽管它比 Fable 5 更小,Anthropic 表示它会更便宜、限制更少,因此更适合大多数使用场景。公司还称,Opus 5 在公告中列出的多项基准测试上超过了 Fable 5。此次发布距离 Opus 4.8 仅过去两个月,后者于 5 月 28 日上线,而 Mythos 5、Fable 5 和 Sonnet 5 都是在 6 月发布的。这样一来,Haiku 成为了仍未升级到 5 系列的唯一模型家族成员。Anthropic 在公告中强调,Opus 5 在自我检查工作和谨慎迭代直到成功方面强得多。
公司举例称,在基准测试中,该模型甚至能在不完整提示下编写自己的计算机视觉管线。Opus 5 也不再受困扰 Fable 的许多限制,不过它仍然不适用于 Fable 和 Mythos 所覆盖的 30 天数据保留政策。Anthropic 表示,它仍保留重要的网络安全防护,包括禁止模型对软件二进制文件进行漏洞扫描,但允许在源代码中查找漏洞,因为后者更可能用于防御用途。公司预计,与 Fable 5 相比,Opus 5 的这些分类器触发频率会低 85%。Anthropic 还推出了 Automatic Fallbacks 的测试版功能:当安全分类器被触发时,系统会自动把请求路由到一个能力较弱的模型,从而让 API 用户得到可用回答,而不是错误信息。

资讯正文
周五,Anthropic 发布了其 Opus 5 模型,这是其长期主力大模型的最新版本。尽管它比 Fable 5 更小,但这款模型会更便宜、限制也更少,因此在大多数使用场景下很可能更受青睐。
值得注意的是,Opus 5 在公告中列出的多项基准测试上,实际上都优于 Fable 5。
Opus 5 的发布时间距离 Opus 4.8 仅隔两个月,后者于 5 月 28 日上线。Mythos 5、Fable 5 和 Sonnet 5 都是在 6 月发布的,这使得目前仍在等待升级到 5 系列的只剩下轻量级的 Haiku 模型。
在宣布这款新模型的博文中,Anthropic 强调,Opus 5 “在验证自身工作以及反复迭代直至成功方面强得多”,并援引了基准测试:在其中一个例子里,Opus 5 会在收到不完整提示后自行编写计算机视觉管线,此外还有其他示例。
至关重要的是,Opus 5 也摆脱了自推出以来一直困扰 Fable 的许多限制。和前代产品一样,Opus 5 不受适用于 Fable 和 Mythos 的 30 天数据保留政策约束,这一政策曾让一些注重隐私的用户感到担忧。
Opus 仍然保留着一些重要的安全防护,尤其是在诸如漏洞利用生成和渗透测试等网络安全任务上。例如,Opus 5 的防护机制会阻止它被用于扫描软件二进制文件中的漏洞,不过它被允许在源代码中查找漏洞,因为后者更可能用于防御目的。
总体而言,Anthropic 预计,这些分类器在 Opus 5 上的触发频率将比在 Fable 5 上低 85%,这反映出对能力较弱的模型采取了更宽松的处理方式。
Anthropic 还在推出一项新工具,以在这些安全防护被触发时降低其干扰性。用户现在可以选择加入名为 Automatic Fallbacks 的测试版功能;当提示词触发安全分类器时,它会自动将请求路由到能力较弱的模型。这样一来,启用该设置的 API 用户将得到一个可用的回复,而不是一条错误信息。
来源与参考
收录于 2026-07-25