
Hermes Agent Pantheon版本通过群聊模式、持久记忆和实时纠偏机制,将多智能体协作从后台流水线升级为可视化团队协作,无需订阅成本即可实现类似Grok Bot的体验。
2026年9月初,开源AI智能体领域迎来一次标志性迭代。Nous Research旗下Hermes Agent发布代号为“Pantheon(万神殿)”的v0.21.0版本,其核心亮点并非单一功能增强,而是将多智能体协作从后台流水线推进到前台群聊时代。这一变化被开发者社区视为对商业产品Grok Bot的正面回应,同时也为开源生态在协作体验上扳回一城。
本文将从多Agent交互模式的转变、后台任务的记忆与纠偏能力、安全机制的同步升级三个维度,解析这次更新如何重构人机协作的底层逻辑,并探讨其对国内AI开源社区的启示。
在传统多Agent系统中,任务流转如同工厂流水线——Agent A完成处理后,将结果单向传递给Agent B。Hermes Pantheon的Bot Mode彻底打破了这种线性结构。桌面端用户现在可以创建类似Discord的独立房间,将多个具备专属名称、头像的Bot拉入同一聊天界面。通过@提及机制,用户能精准调度特定Agent,且任务执行中支持随时中断与改派。
这种设计将智能体从后台工具提升为可对话的协作者。头像由确定性算法生成,亦支持用户自定义,群聊房间可重命名、更换封面,这一系列细节让多Agent协作具备了团队化、可视化的特征。官方数据显示,自上次“传令官”版本以来,项目已合并约2475个PR、5800次代码提交,关闭约2100个issue,760余名贡献者参与其中,可见社区对这一方向的认可度。
除群聊外,新引入的hermes peer命令允许Agent按用户名直接发送私信,且支持跨profile、跨网关通信。例如,一个研究型Bot完成资料搜集后,可将结构化结果直接推送给编程Bot继续执行,全程对话可回放。这解决了此前多Agent协作中“信息中转站”效率低下的痛点,让专业分工的Agent群能够自主形成工作流。
此前,官方将Cron定时任务比作“金鱼”——每次运行都是全新开始。Pantheon版本引入的continuity机制改变了这一局面。定时任务现在能够继承上一次运行的输出结果,并配备独立的持久记事本。以数据监控场景为例,若抓取数据无变化,Agent可根据历史记录跳过模型分析环节,直接复用结论,大幅节省Token消耗。
过去委派子Agent任务如同发射巡航导弹——发射后只能祈祷命中目标。新版本中,用户可在任务执行过程中实时查看子任务进度、发送纠偏指令,甚至提前终止任务并保留已产生的部分结果。同时,任务输出支持JSON Schema格式校验,每次委派的成本直接显示于结果面板,配合默认250次的迭代上限和10个子任务并行能力,让复杂任务的成本与质量变得可量化、可控制。
随着Agent权限扩大,提示词注入攻击的风险同步上升。Pantheon版本对AGENTS.md、技能库、记忆库等关键指令文件增加了写入审批流程,防止恶意提示词悄然篡改Agent的行为准则。
安全补强还覆盖了终端报错、.env文件读取、检查点及ACP日志中的密钥脱敏处理。macOS平台的权限授权改用稳定签名身份维持,显著减少了因应用更新导致的重复授权困扰。
值得注意的是,官方主动撤回了两项已落地的功能:Model Council模式(/council)与DCP上下文引擎。这一取舍表明,项目方在功能堆叠与稳定性之间选择了后者,为开源社区树立了审慎迭代的范例。
Pantheon发布后,部分开发者激进评论称其“干掉了Grok Bot”,认为无订阅限制的群聊模式足以替代马斯克旗下产品。但也有国内开发者指出,新版本多Agent协作在响应速率上仍存在瓶颈,实际生产环境中的实用性需打折扣。这种争议恰恰反映了开源与商业产品在资源投入上的天然差异。
放眼国内,开源Agent生态也在经历类似演进。百度文心一言、阿里通义千问等商业产品虽在模型能力与云服务整合上具备优势,但以DeepSeek、智谱GLM为代表的开源力量,正通过类似Hermes的多Agent协作框架探索差异化路线。例如,智谱近期开放的Agent框架已支持简单的群组任务编排,而Kimi的第三方插件生态也开始尝试记忆持久化功能。国内开源社区的优势在于更贴近本土场景(如电商、政务流程自动化),但在跨网关通信协议标准化、长期记忆的存储成本优化等方面,与Hermes仍存在代际差距。
从“传令官”到“万神殿”,Hermes的演进路径清晰指向更自然的协作形态——Agent拥有身份、房间与记忆,能互相沟通且接受人类实时干预。这已不再是后台流水线,而是一个具备初步社会结构的Agent团队。
然而,正如Nous Research官方发布说明所暗示的,功能堆叠带来的管理复杂度正成为新挑战。如何让一群越来越能干的Bot长期稳定地协同工作,而非在短暂狂欢后陷入混乱,将是“万神殿”真正需要回答的问题。对于整个开源Agent行业而言,Hermes的这次更新证明了自由软件在交互体验上同样能带来惊喜,而国内开发者对速率问题的反馈,也为下一轮优化指明了方向。
核心区别在于开源与成本。Hermes提供无订阅限制的本地化群聊协作,用户可完全掌控数据与部署;而Grok Bot深度绑定商业生态,虽在云端算力与模型优化上有优势,但受订阅费用与平台锁定约束。
持久记忆意味着定时任务不再是每次从零开始。通过开启continuity,任务可继承上次运行结果,并利用持久记事本存储关键状态,从而在数据无变化时跳过重复分析,显著节省计算资源。
用户可在任务执行面板中查看子任务进度,发送文本指令进行中途调整,或直接终止任务并保留已生成结果。这一机制将过去“发射后不管”的委派模式转变为可交互的协作流程。
这两项功能虽已落地,但在稳定性与安全审计中未达发布标准。主动撤回体现了项目方对质量底线的坚持,避免因不成熟功能影响核心协作体验。
Bingdada 是一个专注 SEO、GEO(生成式引擎优化)与 AEO(答案引擎优化)的内容平台,由资深内容编辑、SEO 技术工程师与 AI 研究专家组成的团队持续运营。我们追踪搜索引擎与生成式 AI 的最新动态,为读者提供准确、实用、可落地的方法论与行业洞察。
编辑团队:内容策划 · 技术编辑 · AI 研究组
网站:bingdada.com
© 2026 Bingdada. 保留所有权利。
SEO & GEO 技术探索者,专注于搜索引擎优化和生成式引擎优化。

Hermes Agent的Real Profile Browsing功能允许AI复制用户Chrome登录态并代理操作,实测发现存在Cookie覆盖、macOS解密壁垒等问题。本文对比Claude Code、OpenAI Codex方案,剖析便利背后的安全风险与责任归属,并补充国内AI助手在该领域的进展。

深度评测DeepSeek Harness:这款开源Agent框架以Cordis插件化架构为核心,支持自定义运行时,长程任务能力突出,被视为Agent时代的安卓。

OpenAI 发布 gpt-oss-safeguard 开源安全推理模型(120b 和 20b 两种规格),支持开发者自定义安全策略并通过链式推理进行分类。该模型基于 Apache 2.0 许可证发布,可动态调整策略,无需重新训练,特别适合快速演变的风险场景。
獲取最新的 SEO 與 GEO 技術資訊。
我們尊重您的隱私,隨時可以取消訂閱。