Claude Code 自动模式默认开启

The Decoder··作者 Matthias Bastian

关键信息

Anthropic 表示,1,053 名付费测试用户以及内部红队测试显示,自动模式至少和人工审批一样安全,而且使用该模式的团队大约多生成了 25% 的 pull request。公司还称,分类器和其他保护措施可以降低提示注入风险,但对于高风险的生产基础设施变更,仍建议人工复核。

资讯摘要

Anthropic 表示,Claude Code 很快会默认启用自动模式,这一变化将从 8 月 14 日开始面向 Pro、Max 和 Team 方案推出。Enterprise 用户是例外,仍然需要手动选择开启。自动模式允许这个编码代理在不需要每一步都获得人工批准的情况下继续工作,但在执行被分类器判定为危险或不可逆的操作时,会主动暂停确认。Anthropic 称,他们通过 1,053 名付费测试用户和内部红队测试评估了这一模式,结果显示它至少和人工审批一样安全,而且很多情况下表现更好。公司还表示,启用自动模式的团队大约多生成了 25% 的 pull request,说明产出有所提升。

Anthropic 进一步称,该模式能在一定程度上防御提示注入攻击,也就是恶意指令试图把代理从用户目标上带偏。独立审计机构 Trajectory Labs 测试了 72 种攻击场景,每种重复 10 次,共 720 次尝试,在 Claude 当前模型的自动模式下全部未成功;相比之下,OpenAI 的 GPT-5.6 Sol 在 Codex Auto-Review 模式下有 5.83% 的攻击通过。Anthropic 还举例说,自动模式曾阻止 Claude 将机密数据上传到公开页面,并在一次长会话中终止了约 2,000 个可能干扰 GPU 训练任务的进程。不过,公司也强调,分类器并不能消除所有风险,对于高风险的生产基础设施变更,仍建议开发者亲自审查 Claude 的操作。

Claude Code 自动模式默认开启

资讯正文

Anthropic 将 Claude Code 默认设为 Auto Mode,以帮助开发者避免错误批准

Claude Code 很快将默认以 Auto Mode 运行。只有 Enterprise 客户仍需要手动启用。这一变化意味着 AI 将更自主地处理开发流程中的更多环节。

Auto Mode 让这款 AI 编码工具无需在每一步都等待人工批准即可自行工作。分类器会检查某项操作是否危险或不可逆,并且只在这些情况下才请求确认。

Anthropic 在一篇博客文章中宣布,自 8 月 14 日起,Claude Code 将在 Pro、Max 和 Team 套餐中默认启用 Auto Mode。根据对 1,053 名付费测试者以及内部红队测试的结果,Auto Mode 的表现至少与手动批准一样安全,而且往往更好。使用 Auto Mode 的团队还生成了大约多 25% 的 pull request,这意味着他们完成了更多工作。

Anthropic 还表示,Auto Mode 增加了一层针对 prompt injection 攻击的防护,这类攻击会通过注入的代码试图把 agent 从用户指令上劫持走。Trajectory Labs 的一项独立审计测试了 72 种攻击场景,每种场景重复 10 次。在 Auto Mode 下,Claude 目前的模型 Fable 5、Opus 5 和 Sonnet 5 面对 720 次尝试均未被攻破。相比之下,在 OpenAI 的 GPT-5.6 Sol 的 Codex Auto-Review 模式中,有 5.83% 的攻击成功通过。

在 Anthropic 内部,Auto Mode 曾阻止 Claude 将机密数据上传到一个公开页面。公司表示,在一次长时间会话中,它还终止了大约 2,000 个本会干扰正在进行的 GPU 训练任务的进程。

Anthropic 不会对分类器本身消耗的 token 收费。但将 Auto Mode 设为默认选项,对公司来说很可能仍是一笔划算的买卖。随着 Claude მუშაობ更久、完成更多工作,总 token 使用量会上升,收入也会增加,即便这并不是 Anthropic 推动这一变化的主要动机。

开发者从写代码转向监督 AI 写代码

目前,Claude Code 远远是使用最广泛的 AI 编码工具,而把 Auto Mode 设为默认,会把开发者的角色进一步从主动编码推向审查 AI 生成的输出。Anthropic 自己也提醒要谨慎。

分类器可以降低风险,但并不能消除风险。“对于涉及生产基础设施的高风险变更,我们仍建议您亲自审查 Claude 的操作,”公司写道。

这条建议形成了一个悖论。开发者介入得越少,他们的监督就越重要。但对于大多由 Auto Mode 在缺少大量人工参与的情况下构建起来的项目,要建立起深入理解却会变得更困难。而网络安全的发展速度更快,复杂度增长也超过任何人现实中能够跟上的程度。

来源与参考

  1. 原始链接
  2. Anthropic sets Claude Code to Auto Mode by default to protect developers from bad approvals

收录于 2026-08-09