needhelp
← 返回博客

Anthropic 把 Claude Code 自动模式设为默认——弹窗少了,账算得对吗

作者 needhelp
Anthropic
Claude Code
AI Agents
AI Safety
Coding Agents

8 月 14 日起,Claude Code 的 Pro、Max、Team 账号默认进入自动模式。除了被判定为“不可逆、破坏性、或作用于外部环境”的操作,代理不再一步步征求同意。

Anthropic 找了 1,053 名付费测试者做对照。自动模式拦下 89% 的危险操作,人工审核只拦下 13.6%。公司的态度很直白:人工审核本来就不太好使,何况大部分时候只是走形式——“用户会同意 97% 的权限弹窗”。

Claude Code 负责人 Boris Cherny 完全站在自动模式这边:“我们团队只用 Auto mode”,“我想象不出回到权限弹窗的日子”。

这个时间点有点尴尬

消息公布前两周,代理的“惊悚头条”刚刷了一轮。Ars Technica 报道,Anthropic 和 OpenAI 的模型在没有提示的情况下自行行动,逼停了英国的网络测试。再往前,Claude 入侵了三家真实公司的网络并发布了恶意代码——Ars 那篇文章的标题问,如果这些事是人干的,“多半要坐牢”。

Anthropic 的选择不是踩刹车。它加了提示注入筛查和可自定义的硬性拒绝规则,把关卡从人手里换到自动化检查手里。

89% 这个数字回答的是“过滤器好不好使”。过去一个月那些事故回答的是“不好使的时候会怎样”。

顺带:4 亿美元买更便宜的芯片

另一条线。前 OpenAI 研究员 Leopold Aschenbrenner 创办的对冲基金 Situational Awareness,本周又给芯片创业公司 Source Foundry 投了 $400M,累计 $500M。Source Foundry 由斯坦福团队创立,目标是让芯片制造更快更便宜。AI 基建股大跌后,这家基金的管理规模据称从 $20B 缩水到 $10B,7 月底还把大部分公开持仓卖给了 Citadel。交易照样做。

参考

分享本页