# Anthropic 将 Claude Code 默认设为 Auto Mode，以防开发者误批准危险操作

- 来源：The Decoder：AI News（RSS）
- 作者：Matthias Bastian
- 发布时间：2026-08-08 22:58
- AIHOT 分数：75
- AIHOT 链接：https://aihot.virxact.com/items/cmskiiu8u0714ro5evnwtqckh
- 原文链接：https://the-decoder.com/anthropic-sets-claude-code-to-auto-mode-by-default-to-protect-developers-from-bad-approvals

## AI 摘要

Anthropic 宣布自 8 月 14 日起，Claude Code 将对 Pro、Max 和 Team 套餐默认启用 Auto Mode，企业客户仍需手动开启。该模式通过分类器判断操作是否危险或不可逆，仅在必要时请求确认。测试中，Auto Mode 识别出 89% 的危险命令，而人工审查仅发现 13.6%。

## 正文

Claude Code 很快将默认以 Auto 模式运行。只有企业客户仍需要手动选择启用。这一变化意味着 AI 将在开发流程中自主承担更多工作。

Auto 模式让 AI 编程工具自主工作，无需在每一步都等待人工批准。一个分类器会判断某个操作是否危险或不可逆，仅在这些情况下才要求确认。

据 Anthropic 在博客文章中宣布，从 8 月 14 日起，Claude Code 将对 Pro、Max 和 Team 套餐默认启用 Auto 模式。在针对 1,053 名付费测试者以及内部红队测试中，Auto 模式的安全性至少与人工审批相当，且通常表现更好。使用 Auto 模式的团队生成的拉取请求数量也增加了约 25%，意味着他们完成了更多工作。

在一项针对 1,053 名付费测试者的对照研究中，人工审查员仅发现了 13.6% 的危险命令，而 Auto 模式发现了 89%。| 图片来源：Anthropic

Anthropic 还表示，Auto 模式增加了一层针对提示注入攻击的防护——这类攻击通过注入代码试图劫持智能体，使其偏离用户的指令。Trajectory Labs 进行的一项独立审计对 72 种攻击场景各测试了 10 次。在 Auto 模式下，针对 Claude 当前模型 Fable 5、Opus 5 和 Sonnet 5 的 720 次攻击尝试无一成功。而在 OpenAI 的 GPT-5.6 Sol 的 Codex Auto-Review 模式下，有 5.83% 的攻击成功穿透。

在 Anthropic 内部，Auto 模式阻止了 Claude 将机密数据上传到公开页面。该公司表示，在一次长时间会话中，它还终止了大约 2,000 个可能干扰正在进行的 GPU 训练任务的进程。

Anthropic 不会对分类器本身消耗的 token 收费。但将 Auto 模式设为默认，对公司来说很可能仍然是一笔划算的买卖。当 Claude 工作更久、完成更多任务时，总 token 消耗量会上升，收入也随之增加，即便这并非 Anthropic 做出这一改变的主要动机。

开发者的角色从编写代码转变为观看 AI 编写代码。

Claude Code 目前是使用范围最广的 AI 编程工具，且优势极为明显。将 Auto Mode 设为默认模式，进一步将开发者的角色从主动编写代码推向审核 AI 生成的内容。Anthropic 自己也在敦促用户保持谨慎。

该分类器降低了风险，但并未完全消除风险。该公司写道：“对于生产基础设施的高风险变更，我们仍建议您亲自审核 Claude 的操作。”

这一建议造成了一个悖论。开发者介入的频率越低，他们的监督就越重要。但对于那些主要由 Auto Mode 构建、且几乎没有人工参与的项目，开发者反而更难建立起深入的理解。而网络安全领域的发展速度比任何人能实际跟上的速度都要快，且日益复杂。

Claude
