SOURCE // NEWS

Anthropic 宣布 Claude Code 默认开启自动模式:比人工审查更安全

Anthropic 宣布 Claude Code 默认开启自动模式:比人工审查更安全

Anthropic 宣布,从 8月14日 开始,其命令行 AI 编程工具 Claude Code 将默认为 Pro、Max 和 Team 账户启用“自动模式”(Auto Mode),进一步减少人类在编程过程中的干预,提升开发效率。

该模式于今年 3 月首次推出测试。启用自动模式后,#Claude Code 不再会在每一步都停下来请求人工批准,而是会自主执行一系列任务,除非系统检测到该操作是“不可逆的、破坏性的,或者是针对外部环境的”。

令人惊讶的是,测试数据显示,自动模式甚至比人工审查更加安全。在对 1,053名付费测试者 进行的一项研究中,自动模式成功拦截了 89% 的有害操作,而人工审查仅拦截了 13.6%。这主要是因为人类容易产生“审查疲劳”,在实际操作中,用户对 Claude Code 弹出的权限提示批准率高达 97%,几乎流于形式。

Claude Code 负责人 Boris Cherny 在社交平台 X 上透露,其开发团队自身已经完全转向自动模式数月。为了配合这一默认设置的转变,#Anthropic 还引入了提示词注入筛选(Prompt Injection Screening)和自定义硬拒绝规则(Customizable Hard Deny Rules)等安全新特性,以防止数据外泄。

AgentUpdate 深度解析

这一转变标志着 AI 编程 Agent 正在从“人机协同(Human-in-the-loop)”向“有条件自主执行(Bounded Autonomy)”的关键跨越。过去,行业普遍认为人工审核是安全的最后防线,但 Anthropic 的测试数据无情地揭示了“人类审查疲劳”的软肋——高达 97% 的盲目批准率让手动安全阀几乎形同虚设。相比之下,基于系统级安全防护罩(Guardrails)的自动模式表现出了压倒性的安全优势。横向对比 Cognition 的 Devin 或 GitHub Copilot Workspace,Anthropic 将自动模式设为默认,不仅展示了对其 Agent 规划与控制能力的极高自信,也为整个 AI Agent 生态树立了新范式:未来的 Agent 安全不应寄托于疲惫的人类手指,而应构建在系统级、可编程的主动防御机制之上。