Bingdada 技术博客Bingdada 技术博客
首页博客SEOGEOAEOAI工具关于
登录注册
Logo

Bingdada 技术博客

专注于SEO搜索引擎优化和GEO生成式引擎优化以及未来人工智能发展趋势的技术博客

快速链接

  • 首页
  • 博客文章
  • 关于我们

联系方式

  • 398848662@qq.com

订阅我们的 Newsletter,获取最新的 SEO 和 GEO 技术资讯。

© 2024 Bingdada 技术博客. All rights reserved.

首页博客AI人工智能AI自我进化没那么快:新研究揭示智能体在开放式研究上的短板
AI自我进化没那么快:新研究揭示智能体在开放式研究上的短板
AI人工智能

AI自我进化没那么快:新研究揭示智能体在开放式研究上的短板

bingdadabingdada
八月 24, 202623 次阅读约 9 分钟阅读
快速回答

一项新研究发现,AI智能体虽能完成研究所需的工程任务,但在提出原创假设、进行创造性判断等开放式研究环节上表现糟糕,其产出被顶级会议拒绝。这表明,尽管AI自我改进是可能的方向,但其实现速度可能比一些乐观预测要慢得多,当前AI更适合作为研究辅助工具。

核心要点
  • AI智能体在文献综述、运行实验等工程任务上表现出色,但在开放式研究上缺乏创造力和判断力。
  • 普林斯顿大学团队提出的“影子评估”方法,利用未发表论文测试AI,能更真实反映其研究能力。
  • 智能体产出的研究论文质量远未达到NeurIPS等顶级会议标准,被原作者拒绝。
  • 智能体难以整合反馈、利用资源,且无法从失败的方法中回头,是其失败的主要原因。
  • 研究凸显了当前强化学习训练范式在开放式任务上的局限性,对AI自我改进的激进时间线提出质疑。
目录

目录

  • 引言:AI自我改进的承诺与现实
  • 研究揭示的“工程能力”与“研究能力”鸿沟
  • “影子评估”:一种新的测试方法
  • 实验过程与令人失望的结果
  • 工程上的成功与研究上的失败
  • 创造力与判断力的缺失
  • 资源利用与反馈整合的失败
  • 值得注意的正面发现
  • 训练方式与开放式研究的根本矛盾
  • 国内视角:本土大模型的探索与挑战
  • 结论:对AI发展时间线的重新校准
  • 常见问题
  • AI的递归自我改进具体指什么?
  • 为什么“影子评估”能更真实地测试AI的研究能力?
  • 这项研究是否意味着AI无法进行任何有用的研究?
  • 当前AI的训练方式如何限制了其开放式研究能力?
  • 这是否意味着关于AI发展速度的预测都被夸大了?
  • 关于 Bingdada

引言:AI自我改进的承诺与现实

人工智能行业最引人注目的承诺之一,是AI即将能够实现自我改进,几乎无需人类干预。大型语言模型(LLM)已经能够编写代码、生成用于训练的综合数据,甚至优化自身运行的计算机芯片。一些预测认为,被研究人员称为“递归自我改进”的爆炸性AI进展即将到来。然而,一项新研究泼了一盆冷水,表明我们距离这一目标可能还有一段距离。

研究揭示的“工程能力”与“研究能力”鸿沟

由普林斯顿大学的Peter Kirgis和Sayash Kapoor领导的多机构研究小组发现,AI智能体能够解决AI研究所需的工程问题,但在判断力和创造力方面存在明显不足,无法产出达到顶级机器学习会议接收标准的高质量原创研究。这一差距表明,关于自动化AI研究的一些夸大时间表可能跑在了证据前面。

“影子评估”:一种新的测试方法

现有关于智能体如何自动化AI研究的大多数研究,都侧重于评估它们完成具有可验证答案的狭窄任务的能力,例如解决工程问题或针对基准测试对小型语言模型进行后训练。但AI研究的进步还需要开放式思维——选择一组假设,决定哪些证据能解答问题,或知道何时该推倒重来。

为了测试智能体在这类技能上的表现,研究人员提出了一种名为“影子评估”的新评估方法。该方法要求AI回答来自高质量未发表论文的研究问题。在这项研究中,研究人员让Anthropic的Claude Opus 4.5(在名为OpenClaw的开源软件上运行)来处理这些问题,这些问题来自提交给著名机器学习会议NeurIPS 2026的两篇论文。

第一个问题是,大型语言模型的“人格”(决定其行为的因素)能否通过编辑模型的权重(存储其在训练中学到的一切的数十亿个数字)来控制。另一个问题是如何设计一个检测器,用于指出基于电子表格数据进行预测的模型何时变得不可靠。由于这些论文尚未公开,智能体无法从其训练数据中记忆答案,也无法在线找到它们。

实验过程与令人失望的结果

智能体获得了六天时间、价值3000美元的Anthropic API积分、用于运行实验的GPU预算、自己的虚拟计算机以及访问开放网络的权限,目标是产出一篇能在顶级AI会议上发表的论文。论文的原作者像评估会议投稿一样对智能体的论文进行了评分。

结果是,两位作者都拒绝了这两篇论文。

工程上的成功与研究上的失败

人类科学家发现,智能体能够完成进行研究所需的所有工程工作。它们查阅了文献,运行了数百次实验,并整理了结果。然而,正如Kapoor所说,“另一方面,智能体在进行研究本身方面明显表现不佳。”它们运行了一些奇怪的实验(在某些情况下,在极小的综合数据集上测试假设),难以清晰地撰写关于其工作的内容,并且没有为其领域做出新颖贡献。Kapoor表示:“就达到顶级AI会议的质量而言,这些论文还差得很远。”

创造力与判断力的缺失

智能体表现不佳的原因在于,它们难以调动进行研究所需的创造力和判断力。它们在探索不同想法上做得不够,并且过早地投入到没有前景的方法上。尽管智能体提出了新颖且雄心勃勃的假设,与原作者最初的设想相似,但它们却基于非常有限的数据拒绝了这些假设。它们无法从失败的方法中回头。它们可以进行小的调整,但无法从根本上重新思考其方法或从头开始尝试新方法。

资源利用与反馈整合的失败

此外,智能体还未能整合来自子智能体或外部AI审查工具的反馈。它们没有修订方法论,反而收窄了主张并增加了附加条件。它们也无法有效利用资源,如令牌、计算力和时间。它们还不能遵循关于研究不同阶段应花费多少时间或论文篇幅多长等指示。

值得注意的正面发现

尽管存在种种失败,但智能体没有表现出研究人员所称的“奖励黑客”行为,即隐藏或歪曲实验或数据。虽然子智能体(主智能体生成的用于处理部分工作的辅助AI)偶尔会出现幻觉或歪曲结果,但这些都被编排者智能体(监督项目的首席AI)发现了。

训练方式与开放式研究的根本矛盾

Kapoor认为,AI模型擅长研究工程而非开放式研究的原因,可能归结于它们的训练方式。模型在一种称为强化学习的训练机制中,会因在可自动检查成功与否的任务上得到反复训练而变得擅长这些任务。“但当任务本身是开放式的时候,为这些模型创造训练环境就变得更加困难,”他说。

国内视角:本土大模型的探索与挑战

这一研究结果对国内AI领域同样具有重要的参考价值。目前,国内的大模型公司如百度(文心一言)、阿里巴巴(通义千问)、深度求索(DeepSeek)、字节跳动(豆包)等,也在积极探索AI智能体在代码生成、数据处理等领域的应用。然而,与OpenAI、Anthropic等海外前沿机构类似,国内模型在需要深度原创性、复杂判断力和跨领域整合能力的开放式研究任务上,同样面临挑战。这提示我们,在追求模型参数规模和工程能力提升的同时,更需要关注如何通过算法创新(如更高效的强化学习、世界模型等)来弥补模型在“品味”和“创造力”上的短板。

结论:对AI发展时间线的重新校准

这项研究对“AI即将实现递归自我改进”的乐观预测提出了有力质疑。它清晰地表明,尽管AI在特定工程任务上已经表现出色,但距离真正的自主科学研究仍有显著差距。这种差距的核心在于,当前AI的训练范式——强化学习——在目标明确、反馈可自动化的任务上效果显著,但在需要开放性探索、创造性假设和主观判断的研究工作中,其局限性暴露无遗。因此,我们或许需要重新校准对AI发展速度的预期。短期内,AI更可能作为强大的研究辅助工具,增强人类科学家的能力,而非完全取代他们。要实现真正的“自我改进”,可能需要全新的AI架构或训练范式,这仍是一个待解的科学难题。

常见问题

AI的递归自我改进具体指什么?

递归自我改进指的是AI系统能够自主地改进自身的能力,包括编写更好的代码、设计更优的算法,甚至优化自身的硬件和训练数据,形成一个持续加速的改进循环,从而可能带来指数级的智能增长。

为什么“影子评估”能更真实地测试AI的研究能力?

因为“影子评估”使用了尚未发表的论文作为测试题目,这确保了AI无法通过记忆训练数据或联网搜索来“作弊”获取答案。它要求AI真正理解问题、进行推理并生成原创的解决方案,从而更真实地反映其进行开放式研究的能力。

这项研究是否意味着AI无法进行任何有用的研究?

并非如此。研究表明,AI在文献综述、运行实验、代码编写等研究工程环节表现出色。它们的主要短板在于提出原创假设、进行创造性判断、从失败中学习以及整合反馈等更高层次的认知活动。因此,AI目前更适合作为辅助研究工具。

当前AI的训练方式如何限制了其开放式研究能力?

当前主流的训练方式,尤其是强化学习,依赖于明确定义的目标和可自动检查的反馈信号。在开放式研究任务中,问题的答案不唯一,且“好”的标准难以量化,这使得创建有效的训练环境变得极其困难,从而限制了模型在这类任务上的能力提升。

这是否意味着关于AI发展速度的预测都被夸大了?

这项研究为关于“AI自我改进”的极端乐观预测提供了一个重要的反面证据。它表明,在实现完全自主的AI研究之前,仍存在根本性的科学和工程挑战。虽然这并不意味着AI发展会停滞,但它确实要求我们以更审慎、更基于证据的态度看待那些激进的时间线预测。

关于 Bingdada

Bingdada 是一个专注 SEO、GEO(生成式引擎优化)与 AEO(答案引擎优化)的内容平台,由资深内容编辑、SEO 技术工程师与 AI 研究专家组成的团队持续运营。我们追踪搜索引擎与生成式 AI 的最新动态,为读者提供准确、实用、可落地的方法论与行业洞察。

编辑团队:内容策划 · 技术编辑 · AI 研究组
网站:bingdada.com

© 2026 Bingdada. 保留所有权利。

目录

  • 引言:AI自我改进的承诺与现实
  • 研究揭示的“工程能力”与“研究能力”鸿沟
  • “影子评估”:一种新的测试方法
  • 实验过程与令人失望的结果
  • 工程上的成功与研究上的失败
  • 创造力与判断力的缺失
  • 资源利用与反馈整合的失败
  • 值得注意的正面发现
  • 训练方式与开放式研究的根本矛盾
  • 国内视角:本土大模型的探索与挑战
  • 结论:对AI发展时间线的重新校准
  • 常见问题
  • AI的递归自我改进具体指什么?
  • 为什么“影子评估”能更真实地测试AI的研究能力?
  • 这项研究是否意味着AI无法进行任何有用的研究?
  • 当前AI的训练方式如何限制了其开放式研究能力?
  • 这是否意味着关于AI发展速度的预测都被夸大了?
  • 关于 Bingdada
常见问题
黄金广告位 · 限时招商
广告位招商中

把品牌放进读者的阅读流

文章内广告位,高注意力场景,适合新品发布与活动招募。

商务合作

标签

#AI智能体#AI自我改进#递归自我改进#开放式研究#影子评估
bingdada

bingdada

SEO & GEO 技术探索者,专注于搜索引擎优化和生成式引擎优化。

相关文章

Gemini API 托管代理全面升级:3.6 Flash 默认模型、环境钩子与成本控制
AI人工智能

Gemini API 托管代理全面升级:3.6 Flash 默认模型、环境钩子与成本控制

Google DeepMind 升级 Gemini API 托管代理,默认启用 3.6 Flash 模型,新增环境钩子、预算控制与免费层,强化智能体自动化与安全管控。

8月 22约 7 分钟阅读
AI智能体规模化落地:可信数据基础设施是关键
AI人工智能

AI智能体规模化落地:可信数据基础设施是关键

AI智能体规模化落地,数据基础设施是关键。调查显示,数据领先型企业对智能体决策的信任度达100%,而落后型企业仅为30%。本文探讨如何通过数据虚拟化、治理与实时流,构建可信数据环境。

8月 13约 8 分钟阅读
DeepSeek V4 Pro正式版发布:Agent能力全面升级,直面Claude Fable 5竞争
国产 AI 前线

DeepSeek V4 Pro正式版发布:Agent能力全面升级,直面Claude Fable 5竞争

DeepSeek V4 Pro正式版API发布,Agent能力全面增强,在Cybergym、AutomationBench等基准测试中超越Claude Fable 5,编程智能体测试DeepSWE得分从12.8飙升至62.7,同时面临定价上调与思维链表现差异等挑战。

8月 13约 6 分钟阅读

订阅我们的 Newsletter

获取最新的 SEO 与 GEO 技术资讯。

我们尊重您的隐私,随时可以取消订阅。

评论 ({count}) (0)

登录后即可参与讨论

登录注册
还没有评论,来抢沙发吧