Bingdada Tech BlogBingdada Tech Blog
HomeBlogSEOGEOAEOAIToolsAbout
Log inSign up
Logo

Bingdada Tech Blog

A technical blog focused on SEO, GEO, and future AI trends.

Quick Links

  • Home
  • Blog Posts
  • About Us

Contact

  • 398848662@qq.com

Subscribe to our Newsletter for the latest SEO and GEO insights.

© 2024 Bingdada 技术博客. All rights reserved.

This article is in Simplified Chinese. Translate it to English with one click.
HomeBlog国产 AI 前线Claude Code 5天后默认开启自动模式,Anthropic 自掏腰包承担额外成本
Claude Code 5天后默认开启自动模式,Anthropic 自掏腰包承担额外成本
国产 AI 前线

Claude Code 5天后默认开启自动模式,Anthropic 自掏腰包承担额外成本

bingdadabingdada
August 11, 202680 reads6 min read
Quick Answer

Anthropic 宣布 5 天后 Claude Code 将默认启用自动模式,用 AI 安全分类器替代人工权限审批。分类器的额外 token 消耗由 Anthropic 自行承担,不会向用户收费。数据显示自动模式拦截危险命令的效率远高于人类,且不会随会话时长衰减。

Key Takeaways
  • Anthropic 宣布 5 天后 Claude Code 默认启用自动模式,分类器额外 token 成本由公司承担
  • 受控实验显示自动模式拦截危险命令比例达 89%,远高于人类的 13.6%
  • 生产数据表明自动模式下有害操作发生率仅为人工审批的 38%
  • 经过对抗测试加固后,分类器漏检率从 12% 降至 7%
  • 用户可通过 Shift+Tab 随时切换回手动审批模式
Contents

Contents

  • 人工审批的信任危机
  • 自动模式的压倒性优势
  • 生产环境的真实数据
  • 对抗测试与安全加固
  • 新增安全能力
  • 国内视角
  • 切换与配置
  • 常见问题
  • Claude Code
  • 自动模式的安全拦截率有多高?
  • 如何切换回手动审批模式?
  • 自动模式能完全替代人工审批吗?
  • 国内用户可以使用
  • 关于 Bingdada

AI 编程工具正在经历一场静默的革命。当开发者们对弹窗审批逐渐麻木,Anthropic 决定用一套 AI 安全分类器接管权限判断——并为此买单。

人工审批的信任危机

Anthropic 调研发现,开发者对 Claude Code 权限提示的同意率高达 97%,而对 AI 生成计划的拒绝率却达到 39%。这种巨大的反差揭示了一个事实:人工审批正在沦为一种形式主义。 更令人担忧的是,截至 2026 年 6 月,已有 49.5% 的活跃 CLI 用户手动编写过 Bash allow-rule,其中 5% 直接放行任意 shell 命令,43% 写入了近乎等效的解释器规则。与此同时,62% 的用户使用过 bypassPermissions 功能,25% 的交互式会话从一开始就运行在无权限限制模式下。

自动模式的压倒性优势

Anthropic 与研究机构合作开展了一项受控实验,招募 1053 名付费专业测试者。实验结果显示: - 人类测试者拦截危险命令的比例仅为 13.6%

  • 自动模式(auto mode)的拦截率高达 89%
  • 自动模式拦下了 800 条人类放行的危险命令
  • 人类仅拦下了 6 条自动模式放行的命令 值得注意的是,人类的表现随会话时长显著下滑:前期能拦截约 17% 的危险命令,经历 50 条以上提示后骤降至约 5%。而自动模式的拦截率始终保持稳定。

生产环境的真实数据

Anthropic 对 2026 年 5 月至 6 月的生产数据重新评分后发现,在 7 级及以上严重级别(如删除生产数据库记录)的会话中: - 人工审批模式下,6.3% 出现了用户未明确要求的有害操作

  • 自动模式会话中,这一比例降至 2.4% 这一差距在测试过的每个严重级别上都成立,充分证明了自动模式在实际场景中的可靠性。

对抗测试与安全加固

Anthropic 与 AI 安全公司 Apollo Research 合作进行了为期两周的对抗测试。通过注入合成攻击样本,Anthropic 为分类器增加了更多环境上下文,包括仓库可见性、git 状态和数据处理规则。加固后,自动模式的漏检率从 12% 降至 7%。 针对提示词注入攻击,第三方机构 Trajectory Labs 的评测显示,运行自动模式的 Claude 模型在 720 次攻击尝试中无一被攻破,而 OpenAI 的 GPT-5.6 Sol 在 Full Access 模式下攻击成功率达 19.03%。

新增安全能力

Claude Code 近期新增了多项安全特性: 1. 将数据外泄列为 hard deny,分类器永不批准

  1. 区分密钥与敏感信息的可访问和可分享范围
  2. 在 git push 或 PR 执行前检查目标仓库属性
  3. 在 git reset --hard 等危险命令前读取 git status
  4. 由 API 侧探针扫描注入企图并添加警告 关于模型安全评估的更多方法论,可参考 OpenAI 的安全评估指南。

国内视角

国内 AI 编程工具同样在安全与效率之间寻找平衡。阿里云 通义灵码 已推出企业级代码安全审计功能,百度文心快码则强调与代码仓库的深度集成。与 Claude Code 的自动模式不同,国内工具更倾向于提供可配置的安全策略模板,让团队根据自身需求定制审批流程。 这种差异反映了不同的产品哲学:Anthropic 倾向于用 AI 直接替代人工判断,而国内厂商更注重提供灵活的治理工具。随着 AI 编程的普及,如何在自动化与可控性之间取得平衡,将成为行业共同面对的课题。

切换与配置

对 Pro、Max、Team 用户而言,新会话将自动以 auto mode 启动。若想切换模式,在 CLI 中按 Shift+Tab,桌面端使用模式下拉菜单即可。管理员可通过 managed settings 中的 defaultMode 固定组织级默认设置,或使用 disableAutoMode 完全关闭自动模式。 Anthropic 在公告中强调,自动模式依赖分类系统,可以降低风险但不能完全消除风险。对生产基础设施的高风险改动,仍建议用户自行审查。

常见问题

Claude Code

自动模式会额外收费吗? 不会。自动模式的分类器每次工具调用会额外消耗少量 token,但 Anthropic 已明确表示这部分开销将不再向用户收费,由公司自行承担。

自动模式的安全拦截率有多高?

在受控实验中,自动模式拦截危险命令的比例达 89%,而人类仅为 13.6%。加固后,分类器对合成攻击的漏检率从 12% 降至 7%。

如何切换回手动审批模式?

在 CLI 中按 Shift+Tab 即可切换模式,桌面端可通过模式下拉菜单操作。管理员也可以在 managed settings 中设置组织级默认模式。

自动模式能完全替代人工审批吗?

不能。Anthropic 明确表示自动模式可以降低风险但不能消除风险,对生产基础设施的高风险改动,仍建议用户自行审查。

国内用户可以使用

Claude Code 自动模式吗? Claude Code 在全球范围内提供服务,但国内用户更常使用通义灵码、文心快码等国产工具。这些工具在安全策略配置上提供了不同的实现方式。 参考链接:

Anthropic 官方公告 ---

关于 Bingdada

Bingdada 是一个专注 SEO、GEO(生成式引擎优化)与 AEO(答案引擎优化)的内容平台,由资深内容编辑、SEO 技术工程师与 AI 研究专家组成的团队持续运营。我们追踪搜索引擎与生成式 AI 的最新动态,为读者提供准确、实用、可落地的方法论与行业洞察。 编辑团队:内容策划 · 技术编辑 · AI 研究组 网站:bingdada.com © 2026 Bingdada. 保留所有权利。

Contents

  • 人工审批的信任危机
  • 自动模式的压倒性优势
  • 生产环境的真实数据
  • 对抗测试与安全加固
  • 新增安全能力
  • 国内视角
  • 切换与配置
  • 常见问题
  • Claude Code
  • 自动模式的安全拦截率有多高?
  • 如何切换回手动审批模式?
  • 自动模式能完全替代人工审批吗?
  • 国内用户可以使用
  • 关于 Bingdada
FAQ
Premium Ad Space · Limited Time
Advertise with us

Put your brand in the reader feed

In-article ad slots: high-attention moments perfect for product launches and event recruitment.

Partnership

Tags

#Claude Code#Anthropic#AI编程工具#国内 AI 公司#自动模式#代码安全
bingdada

bingdada

SEO & GEO 技术探索者,专注于搜索引擎优化和生成式引擎优化。

Related Posts

AI 算力竞赛白热化:从芯片自研到定价策略,科技巨头如何重构竞争版图?
国产 AI 前线

AI 算力竞赛白热化:从芯片自研到定价策略,科技巨头如何重构竞争版图?

从 Anthropic 自研芯片到阿里 800 亿港元募资,再到 API 定价策略调整,AI 竞争已进入算力、资本与合规的多维博弈阶段。本文深度解析行业最新动态,揭示科技巨头如何重构竞争版图。

Aug 247 min read
Anthropic 模型越狱漏洞揭示 AI 安全边界的挑战
AI人工智能

Anthropic 模型越狱漏洞揭示 AI 安全边界的挑战

本文探讨了 Anthropic 的 Claude Opus 4.6 等模型存在的越狱漏洞,该漏洞可被利用生成色情内容,并分析了其安全机制与政策声明之间的差距,以及可能引发的合规和未成年人保护问题。

Aug 226 min read
Anthropic年化收入突破650亿美元,AI商业化竞赛进入新阶段
AI人工智能

Anthropic年化收入突破650亿美元,AI商业化竞赛进入新阶段

Anthropic年化收入突破650亿美元,超过OpenAI,预计2026年达千亿。其IPO估值或达2万亿美元,AI商业化竞赛加速。

Aug 186 min read

Subscribe to our Newsletter

Get the latest SEO & GEO insights.

We respect your privacy. You can unsubscribe at any time.

Comments ({count}) (0)

Sign in to join the discussion

Sign inSign up
No comments yet, be the first to comment