
这轮 AI 末日警告的直接导火索是 Anthropic 研究员 Jacob Coxon 辞职,以及该公司对齐负责人公开称 AI 杀死全人类的概率超过 10%。但该数字缺乏方法论支撑,且警告时机与相关公司上市、融资节奏高度重合,因此既包含真实忧虑,也难以排除商业动机。
过去几周,AI 行业内部围绕「技术是否构成人类生存威胁」的争论达到了前所未有的音量。这场讨论的导火索,是一位曾在 OpenAI 任职、后加入 Anthropic 的年轻研究员 Jacob Coxon 宣布辞职。他给出的理由直白而沉重:担心头部 AI 公司正在「拿我们的生命赌博」。
随后,Anthropic 的对齐(alignment)负责人在社交平台上转发了这一声明,并写下一句让整个行业侧目的话——「我们确实真诚地相信 AI 可能杀死所有人类」,还补充说个人判断这一概率「在未来十年内超过 10%」。感叹号与百分比同时出现,迅速点燃了舆论。
在 TechCrunch 旗下播客 Equity 的一期节目中,Kirsten Korosec、Sean O'Kane 与主持人 Anthony Ha 围绕这轮「末日警告」展开了讨论。需要说明的是,该期节目录制于 Anthropic CEO Dario Amodei 发布其「更谨慎的 AI 开发计划」之前。
Anthony Ha 对那条推文最大的异议,不在于感叹号,而在于主语。「我们」是谁?AI 研究社区能否被当作一个立场统一的整体来谈论?在他看来,把一个多元、分裂、竞争激烈的群体打包成「我们」,本身就是一种修辞上的偷懒。
至于「超过 10%」这个数字,他的评价更为直接:这是一个凭空造出来的数字,既没有计算依据,也无法证伪。科技行业习惯抛出这类百分比,仿佛精确的数字能替代严谨的论证。他后来意识到,这条推文大概率是在引用「P(doom)」——即 AI 导致人类灭绝的概率——这一圈内概念,但即便如此,他仍认为这种表达方式并不严肃。
不过,Anthony 对 Coxon 本人的选择给予了明确肯定。长期以来,当 Sam Altman、Dario Amodei 等人物讲述末日叙事时,外界总有一个绕不开的追问:如果你真的相信这项技术可能毁灭人类,为什么还要继续做下去?
Coxon 的不同之处在于,他把职业选择押在了自己的判断上——他选择离开,而不是一边警告一边加速。用 Anthony 的话说,至少这份勇气值得肯定。
Kirsten Korosec 提出了一个更尖锐的假设:每当又一篇博客披露某个 AI 智能体意外突破限制,或者又有人谈论人类面临风险,这是否是一种奇怪的「秀肌肉」方式?
她的逻辑是:如果这些模型不够先进、不够有能力、也无法突破边界,我们根本不需要担心这些事。换句话说,「危险」本身就成了能力证明。她承认这种解读听起来很犬儒,但它确实达到了某种效果。
Anthony 对此的回应是「部分认同」。他不认为这是一场全员清醒的营销策划,许多研究者和 CEO 在谈论风险时确实怀有真实忧虑。但与此同时,「我们造出了史上最致命的软件」这种说法,在多个层面都与商业利益高度吻合。他还提到一个心理学层面的观察:人们天然倾向于相信自己正在做的事是世界上最重要、最危险的事。
Sean O'Kane 关注的重点略有不同。他认为近期案例中真正令人不安的,是这些公司在某些方面似乎并没有真正掌控局面——OpenAI 相关的内部模型与 Hugging Face 事件、以及不断出现的「内部智能体访问网络 wiki 并互相留言」的报道,都强化了这种感觉。
他还抛出一个颇具黑色幽默的设想:这些担忧会如何写进 Anthropic 的 IPO 招股书(S-1)?「是不是现在有初级律师正在逐字重写那一整段,写成『Anthropic 的官方立场是,我们开发出灭绝全人类之物的概率超过 10%,而这对我们的业务构成重大不利影响』?」
这个玩笑背后是一个真实的治理难题:一旦「存在性风险」被正式写入法律文件,它就不再是播客里的哲学讨论,而是需要向监管机构与投资者负责的披露事项。
值得对照的是,国内大模型厂商在公开叙事上普遍更强调「可控」「可用」「安全治理」的工程化路径,而非存在性风险的哲学辩论。文心一言、通义千问、DeepSeek、豆包、Kimi、智谱 GLM、讯飞星火等产品在迭代节奏上同样迅猛,但围绕「AI 是否会毁灭人类」的公开表态相对克制,讨论更多集中在幻觉控制、内容安全、数据合规与行业落地。
这种差异未必意味着国内厂商对长期风险缺乏思考,而更可能反映了两条不同的产业路径:一方把「风险叙事」当作融资与监管博弈中的筹码,另一方则倾向于把安全议题拆解为可度量、可交付的工程指标。对读者而言,理解这种叙事差异,比单纯接受某一方的措辞更有价值。
面对这类警告,普通读者可以借助以下思路保持判断力:
关于 AI 治理与风险分类,可参考 OECD 人工智能原则 等国际框架,它们提供了比「10%」更具操作性的讨论基础。
直接触发点是 Anthropic 研究员 Jacob Coxon 的辞职声明,以及该公司对齐负责人公开表示「AI 可能杀死所有人类」且概率超过 10%。更深层背景是头部模型能力快速提升、智能体突破限制的事件增多,以及相关公司临近上市带来的披露压力。
目前没有公开的方法论支撑该数字,它更接近圈内「P(doom)」概念的直觉表达,而非经过严谨计算或可验证的统计结果。读者应把它视为一种修辞,而非科学结论。
不能一概而论。部分发言者确实怀有真实忧虑,但「我们造出了极其危险的东西」这一说法在客观上与公司融资、估值和监管博弈的利益方向一致,因此需要结合时机与动机分别判断。
国内厂商公开叙事更偏向工程化安全治理,如幻觉控制、内容合规与行业落地,较少参与「存在性风险」的哲学辩论。这既反映监管环境差异,也体现不同的产业竞争策略。
Bingdada 是一个专注 SEO、GEO(生成式引擎优化)与 AEO(答案引擎优化)的内容平台,由资深内容编辑、SEO 技术工程师与 AI 研究专家组成的团队持续运营。我们追踪搜索引擎与生成式 AI 的最新动态,为读者提供准确、实用、可落地的方法论与行业洞察。
编辑团队:内容策划 · 技术编辑 · AI 研究组
网站:bingdada.com
© 2026 Bingdada. 保留所有权利。
SEO & GEO 技术探索者,专注于搜索引擎优化和生成式引擎优化。

Anthropic、OpenAI、Google DeepMind 与 xAI 罕见地在「放缓大模型发展」上达成公开共识。但细读事故报告会发现,被包装成「力量失控」的事件,更像是一次训练流程缺陷。本文拆解安全叙事与 IPO 竞争逻辑之间的张力。

Claude Opus 5.2 在灰度测试中展现出更快响应、更少废话、更强自主迭代意愿的特征,开发者社区将其形容为告别“偷懒病”。本文梳理实测反馈与行业信号。

Anthropic 预计连续第二个季度实现经调整营业利润,年化营收从 90 亿美元跃升至 650 亿美元。本文从收入结构、毛利率口径与上市预期切入,分析大模型商业化拐点是否真正到来,并对比国产大模型的差异化路径。
最新の SEO・GEO 情報をお届けします。
プライバシーを尊重します。いつでも購読を解除できます。