
Anthropic 宣布 5 天后 Claude Code 将默认启用自动模式,用 AI 安全分类器替代人工权限审批。分类器的额外 token 消耗由 Anthropic 自行承担,不会向用户收费。数据显示自动模式拦截危险命令的效率远高于人类,且不会随会话时长衰减。
AI 编程工具正在经历一场静默的革命。当开发者们对弹窗审批逐渐麻木,Anthropic 决定用一套 AI 安全分类器接管权限判断——并为此买单。
Anthropic 调研发现,开发者对 Claude Code 权限提示的同意率高达 97%,而对 AI 生成计划的拒绝率却达到 39%。这种巨大的反差揭示了一个事实:人工审批正在沦为一种形式主义。 更令人担忧的是,截至 2026 年 6 月,已有 49.5% 的活跃 CLI 用户手动编写过 Bash allow-rule,其中 5% 直接放行任意 shell 命令,43% 写入了近乎等效的解释器规则。与此同时,62% 的用户使用过 bypassPermissions 功能,25% 的交互式会话从一开始就运行在无权限限制模式下。
Anthropic 与研究机构合作开展了一项受控实验,招募 1053 名付费专业测试者。实验结果显示: - 人类测试者拦截危险命令的比例仅为 13.6%
Anthropic 对 2026 年 5 月至 6 月的生产数据重新评分后发现,在 7 级及以上严重级别(如删除生产数据库记录)的会话中: - 人工审批模式下,6.3% 出现了用户未明确要求的有害操作
Anthropic 与 AI 安全公司 Apollo Research 合作进行了为期两周的对抗测试。通过注入合成攻击样本,Anthropic 为分类器增加了更多环境上下文,包括仓库可见性、git 状态和数据处理规则。加固后,自动模式的漏检率从 12% 降至 7%。 针对提示词注入攻击,第三方机构 Trajectory Labs 的评测显示,运行自动模式的 Claude 模型在 720 次攻击尝试中无一被攻破,而 OpenAI 的 GPT-5.6 Sol 在 Full Access 模式下攻击成功率达 19.03%。
Claude Code 近期新增了多项安全特性: 1. 将数据外泄列为 hard deny,分类器永不批准
国内 AI 编程工具同样在安全与效率之间寻找平衡。阿里云 通义灵码 已推出企业级代码安全审计功能,百度文心快码则强调与代码仓库的深度集成。与 Claude Code 的自动模式不同,国内工具更倾向于提供可配置的安全策略模板,让团队根据自身需求定制审批流程。 这种差异反映了不同的产品哲学:Anthropic 倾向于用 AI 直接替代人工判断,而国内厂商更注重提供灵活的治理工具。随着 AI 编程的普及,如何在自动化与可控性之间取得平衡,将成为行业共同面对的课题。
对 Pro、Max、Team 用户而言,新会话将自动以 auto mode 启动。若想切换模式,在 CLI 中按 Shift+Tab,桌面端使用模式下拉菜单即可。管理员可通过 managed settings 中的 defaultMode 固定组织级默认设置,或使用 disableAutoMode 完全关闭自动模式。 Anthropic 在公告中强调,自动模式依赖分类系统,可以降低风险但不能完全消除风险。对生产基础设施的高风险改动,仍建议用户自行审查。
自动模式会额外收费吗? 不会。自动模式的分类器每次工具调用会额外消耗少量 token,但 Anthropic 已明确表示这部分开销将不再向用户收费,由公司自行承担。
在受控实验中,自动模式拦截危险命令的比例达 89%,而人类仅为 13.6%。加固后,分类器对合成攻击的漏检率从 12% 降至 7%。
在 CLI 中按 Shift+Tab 即可切换模式,桌面端可通过模式下拉菜单操作。管理员也可以在 managed settings 中设置组织级默认模式。
不能。Anthropic 明确表示自动模式可以降低风险但不能消除风险,对生产基础设施的高风险改动,仍建议用户自行审查。
Claude Code 自动模式吗? Claude Code 在全球范围内提供服务,但国内用户更常使用通义灵码、文心快码等国产工具。这些工具在安全策略配置上提供了不同的实现方式。 参考链接:
Anthropic 官方公告 ---
Bingdada 是一个专注 SEO、GEO(生成式引擎优化)与 AEO(答案引擎优化)的内容平台,由资深内容编辑、SEO 技术工程师与 AI 研究专家组成的团队持续运营。我们追踪搜索引擎与生成式 AI 的最新动态,为读者提供准确、实用、可落地的方法论与行业洞察。 编辑团队:内容策划 · 技术编辑 · AI 研究组 网站:bingdada.com © 2026 Bingdada. 保留所有权利。
Put your brand in the reader feed
In-article ad slots: high-attention moments perfect for product launches and event recruitment.
SEO & GEO 技术探索者,专注于搜索引擎优化和生成式引擎优化。

从 Anthropic 自研芯片到阿里 800 亿港元募资,再到 API 定价策略调整,AI 竞争已进入算力、资本与合规的多维博弈阶段。本文深度解析行业最新动态,揭示科技巨头如何重构竞争版图。

本文探讨了 Anthropic 的 Claude Opus 4.6 等模型存在的越狱漏洞,该漏洞可被利用生成色情内容,并分析了其安全机制与政策声明之间的差距,以及可能引发的合规和未成年人保护问题。

Anthropic年化收入突破650亿美元,超过OpenAI,预计2026年达千亿。其IPO估值或达2万亿美元,AI商业化竞赛加速。
Get the latest SEO & GEO insights.
We respect your privacy. You can unsubscribe at any time.