Bingdada 기술 블로그Bingdada 기술 블로그
홈블로그SEOGEOAEOAI도구소개
로그인회원가입
Logo

Bingdada 기술 블로그

SEO, GEO 및 미래 AI 트렌드에 초점을 맞춘 기술 블로그.

빠른 링크

  • 홈
  • 블로그 글
  • 소개

연락처

  • 398848662@qq.com

최신 SEO·GEO 정보를 받아볼래 뉴스레터를 구독하세요.

© 2024 Bingdada 技术博客. All rights reserved.

이 글은 간체 중국어입니다. 한국어(으)로 번역하려면 클릭하세요.
홈블로그国产 AI 前线Claude Code 5天后默认开启自动模式,Anthropic 自掏腰包承担额外成本
Claude Code 5天后默认开启自动模式,Anthropic 自掏腰包承担额外成本
国产 AI 前线

Claude Code 5天后默认开启自动模式,Anthropic 自掏腰包承担额外成本

bingdadabingdada
8월 11, 202678회 읽음약 6분 분량
post.quickAnswer

Anthropic 宣布 5 天后 Claude Code 将默认启用自动模式,用 AI 安全分类器替代人工权限审批。分类器的额外 token 消耗由 Anthropic 自行承担,不会向用户收费。数据显示自动模式拦截危险命令的效率远高于人类,且不会随会话时长衰减。

post.keyTakeaways
  • Anthropic 宣布 5 天后 Claude Code 默认启用自动模式,分类器额外 token 成本由公司承担
  • 受控实验显示自动模式拦截危险命令比例达 89%,远高于人类的 13.6%
  • 生产数据表明自动模式下有害操作发生率仅为人工审批的 38%
  • 经过对抗测试加固后,分类器漏检率从 12% 降至 7%
  • 用户可通过 Shift+Tab 随时切换回手动审批模式
목차

목차

  • 人工审批的信任危机
  • 自动模式的压倒性优势
  • 生产环境的真实数据
  • 对抗测试与安全加固
  • 新增安全能力
  • 国内视角
  • 切换与配置
  • 常见问题
  • Claude Code
  • 自动模式的安全拦截率有多高?
  • 如何切换回手动审批模式?
  • 自动模式能完全替代人工审批吗?
  • 国内用户可以使用
  • 关于 Bingdada

AI 编程工具正在经历一场静默的革命。当开发者们对弹窗审批逐渐麻木,Anthropic 决定用一套 AI 安全分类器接管权限判断——并为此买单。

人工审批的信任危机

Anthropic 调研发现,开发者对 Claude Code 权限提示的同意率高达 97%,而对 AI 生成计划的拒绝率却达到 39%。这种巨大的反差揭示了一个事实:人工审批正在沦为一种形式主义。 更令人担忧的是,截至 2026 年 6 月,已有 49.5% 的活跃 CLI 用户手动编写过 Bash allow-rule,其中 5% 直接放行任意 shell 命令,43% 写入了近乎等效的解释器规则。与此同时,62% 的用户使用过 bypassPermissions 功能,25% 的交互式会话从一开始就运行在无权限限制模式下。

自动模式的压倒性优势

Anthropic 与研究机构合作开展了一项受控实验,招募 1053 名付费专业测试者。实验结果显示: - 人类测试者拦截危险命令的比例仅为 13.6%

  • 自动模式(auto mode)的拦截率高达 89%
  • 自动模式拦下了 800 条人类放行的危险命令
  • 人类仅拦下了 6 条自动模式放行的命令 值得注意的是,人类的表现随会话时长显著下滑:前期能拦截约 17% 的危险命令,经历 50 条以上提示后骤降至约 5%。而自动模式的拦截率始终保持稳定。

生产环境的真实数据

Anthropic 对 2026 年 5 月至 6 月的生产数据重新评分后发现,在 7 级及以上严重级别(如删除生产数据库记录)的会话中: - 人工审批模式下,6.3% 出现了用户未明确要求的有害操作

  • 自动模式会话中,这一比例降至 2.4% 这一差距在测试过的每个严重级别上都成立,充分证明了自动模式在实际场景中的可靠性。

对抗测试与安全加固

Anthropic 与 AI 安全公司 Apollo Research 合作进行了为期两周的对抗测试。通过注入合成攻击样本,Anthropic 为分类器增加了更多环境上下文,包括仓库可见性、git 状态和数据处理规则。加固后,自动模式的漏检率从 12% 降至 7%。 针对提示词注入攻击,第三方机构 Trajectory Labs 的评测显示,运行自动模式的 Claude 模型在 720 次攻击尝试中无一被攻破,而 OpenAI 的 GPT-5.6 Sol 在 Full Access 模式下攻击成功率达 19.03%。

新增安全能力

Claude Code 近期新增了多项安全特性: 1. 将数据外泄列为 hard deny,分类器永不批准

  1. 区分密钥与敏感信息的可访问和可分享范围
  2. 在 git push 或 PR 执行前检查目标仓库属性
  3. 在 git reset --hard 等危险命令前读取 git status
  4. 由 API 侧探针扫描注入企图并添加警告 关于模型安全评估的更多方法论,可参考 OpenAI 的安全评估指南。

国内视角

国内 AI 编程工具同样在安全与效率之间寻找平衡。阿里云 通义灵码 已推出企业级代码安全审计功能,百度文心快码则强调与代码仓库的深度集成。与 Claude Code 的自动模式不同,国内工具更倾向于提供可配置的安全策略模板,让团队根据自身需求定制审批流程。 这种差异反映了不同的产品哲学:Anthropic 倾向于用 AI 直接替代人工判断,而国内厂商更注重提供灵活的治理工具。随着 AI 编程的普及,如何在自动化与可控性之间取得平衡,将成为行业共同面对的课题。

切换与配置

对 Pro、Max、Team 用户而言,新会话将自动以 auto mode 启动。若想切换模式,在 CLI 中按 Shift+Tab,桌面端使用模式下拉菜单即可。管理员可通过 managed settings 中的 defaultMode 固定组织级默认设置,或使用 disableAutoMode 完全关闭自动模式。 Anthropic 在公告中强调,自动模式依赖分类系统,可以降低风险但不能完全消除风险。对生产基础设施的高风险改动,仍建议用户自行审查。

常见问题

Claude Code

自动模式会额外收费吗? 不会。自动模式的分类器每次工具调用会额外消耗少量 token,但 Anthropic 已明确表示这部分开销将不再向用户收费,由公司自行承担。

自动模式的安全拦截率有多高?

在受控实验中,自动模式拦截危险命令的比例达 89%,而人类仅为 13.6%。加固后,分类器对合成攻击的漏检率从 12% 降至 7%。

如何切换回手动审批模式?

在 CLI 中按 Shift+Tab 即可切换模式,桌面端可通过模式下拉菜单操作。管理员也可以在 managed settings 中设置组织级默认模式。

自动模式能完全替代人工审批吗?

不能。Anthropic 明确表示自动模式可以降低风险但不能消除风险,对生产基础设施的高风险改动,仍建议用户自行审查。

国内用户可以使用

Claude Code 自动模式吗? Claude Code 在全球范围内提供服务,但国内用户更常使用通义灵码、文心快码等国产工具。这些工具在安全策略配置上提供了不同的实现方式。 参考链接:

Anthropic 官方公告 ---

关于 Bingdada

Bingdada 是一个专注 SEO、GEO(生成式引擎优化)与 AEO(答案引擎优化)的内容平台,由资深内容编辑、SEO 技术工程师与 AI 研究专家组成的团队持续运营。我们追踪搜索引擎与生成式 AI 的最新动态,为读者提供准确、实用、可落地的方法论与行业洞察。 编辑团队:内容策划 · 技术编辑 · AI 研究组 网站:bingdada.com © 2026 Bingdada. 保留所有权利。

목차

  • 人工审批的信任危机
  • 自动模式的压倒性优势
  • 生产环境的真实数据
  • 对抗测试与安全加固
  • 新增安全能力
  • 国内视角
  • 切换与配置
  • 常见问题
  • Claude Code
  • 自动模式的安全拦截率有多高?
  • 如何切换回手动审批模式?
  • 自动模式能完全替代人工审批吗?
  • 国内用户可以使用
  • 关于 Bingdada
post.faq
프리미엄 광고 영역 · 한정 기간
광고 문의

브랜드를 독자의 피드에 올리세요

본문 내 광고 영역은 높은 주목도를 가진 순간으로, 신제품 출시와 이벤트 모집에 적합합니다.

비즈니스 문의

태그

#Claude Code#Anthropic#AI编程工具#国内 AI 公司#自动模式#代码安全
bingdada

bingdada

SEO & GEO 技术探索者,专注于搜索引擎优化和生成式引擎优化。

관련 글

AI 算力竞赛白热化:从芯片自研到定价策略,科技巨头如何重构竞争版图?
国产 AI 前线

AI 算力竞赛白热化:从芯片自研到定价策略,科技巨头如何重构竞争版图?

从 Anthropic 自研芯片到阿里 800 亿港元募资,再到 API 定价策略调整,AI 竞争已进入算力、资本与合规的多维博弈阶段。本文深度解析行业最新动态,揭示科技巨头如何重构竞争版图。

8월 24약 7분 분량
Anthropic 模型越狱漏洞揭示 AI 安全边界的挑战
AI人工智能

Anthropic 模型越狱漏洞揭示 AI 安全边界的挑战

本文探讨了 Anthropic 的 Claude Opus 4.6 等模型存在的越狱漏洞,该漏洞可被利用生成色情内容,并分析了其安全机制与政策声明之间的差距,以及可能引发的合规和未成年人保护问题。

8월 22약 6분 분량
Anthropic年化收入突破650亿美元,AI商业化竞赛进入新阶段
AI人工智能

Anthropic年化收入突破650亿美元,AI商业化竞赛进入新阶段

Anthropic年化收入突破650亿美元,超过OpenAI,预计2026年达千亿。其IPO估值或达2万亿美元,AI商业化竞赛加速。

8월 18약 6분 분량

뉴스레터 구독

최신 SEO·GEO 정보를 받아보세요.

개인정보를 존중합니다. 언제든 구독을 취소할 수 있습니다.

댓글 ({count}) (0)

로그인하여 토론에 참여하세요

로그인가입
아직 댓글이 없습니다. 첫 댓글을 작성해 주세요