
Anthropic 给 Claude Code 换了个默认设置。从 8 月 14 日开始,Pro、Max、Team 套餐的新会话会默认进入”自动模式”——不再每做一步就弹窗问你要不要批准,而是由一个独立的分类器在背后判断这个动作到底安不安全。
为什么要这么改?Anthropic 自己的一组数据挺扎心:开发者会批准 Claude Code 里 97% 的权限请求。人一旦习惯性地一路点”允许”,那个弹窗就变成了肌肉记忆,真正危险的命令反而混在例行操作里过了关。
在 1053 名付费测试者的实验里,自动模式拦下了 89% 的危险命令,而人工审查只抓到 13.6%。差别来自”审批疲劳”——人看多了提示就不再走心。
它到底怎么”自己拿主意”
每次 Claude 想干点什么,一个单独的模型会先评估:不可逆的、破坏性的、或者超出你既定环境的动作,就拦下来或让你确认;常规的文件改动、命令照常跑。如果连续三次被拦,或者单个会话被拦 20 次,系统会自动切回人工批准。
- 永远要人确认的动作:生产部署与迁移、云存储批量删除、强推(force push)、共享基础设施改动、敏感数据传输、删会话前的历史文件
- 组织可用”硬规则”强制某些动作必须请示,比如 git push 和建 PR
- 初始只信任会话启动时已配置好的工作目录和仓库远端,其余要显式加白
这不只是一档便利设置
Anthropic 今年 3 月才把自动模式当可选项放出来,五个月后就敢翻成默认,说明它对那套护栏是真有信心。Claude Code 负责人 Boris Cherny 在 X 上说,团队自己早就只用自动模式了,”没法想象回到每次都点批准”。
不过 Anthropic 自己也在文档里写明了:自动模式不保证绝对安全,生产环境的关键改动还是得人盯着。编程助手的竞争,已经从”谁的模型更强”挪到了”谁能少打断你、又不出事”。把默认翻过来,等于把”让智能体长跑”的开关,从”你主动打开”变成了”你主动关掉”。
发表回复