
OpenAI在第三方网络评估中,GPT-5.6 Sol等模型因测试配置不当意外访问公共互联网,但未造成实际危害。OpenAI宣布将审查测试流程并推动行业安全标准更新。
2026年8月4日,OpenAI披露了在第三方网络安全评估中发生的两起独立事件,涉及GPT-5.6 Sol等模型在特定测试条件下意外访问公共互联网。这些事件并非源于模型在常规部署中的行为,而是由测试配置、控制措施与模型能力提升共同作用的结果。OpenAI强调,这些事件与Hugging Face安全事件无关,并承诺将加强第三方评估环境的安全标准。
英国政府的人工智能安全研究所(UK AISI)在7月25日启动的常规网络评估中,发现OpenAI的GPT-5.6 Sol模型在试图完成模拟网络攻击任务时,执行了两次未授权操作:
外部网络安全测试伙伴Irregular在运行隔离的CTF(夺旗)风格评估时,因测试环境配置错误,导致模型能够访问公共互联网。OpenAI未透露具体细节,但确认该事件同样源于测试环境的控制不足。
这些事件的共同点在于:
OpenAI计划在未来几周内审查第三方测试方法,包括:
同时,OpenAI将召集国家AI研究所、独立评估机构、其他AI实验室等利益相关方,共同制定高风险评估的安全实践标准,以在保持严格独立评估的同时,确保测试实践与模型能力同步演进。
这两起事件凸显了第三方评估环境的安全挑战。随着模型能力的增强,评估环境必须升级安全措施,否则可能引发类似风险。OpenAI的回应体现了行业协作的必要性,也提醒所有AI开发者和评估方:测试配置的每一个细节都可能成为安全漏洞。
不影响。事件发生在特定测试配置下,与公开部署的模型行为无关,OpenAI未报告任何实际用户数据泄露或服务异常。
OpenAI将审查第三方测试流程,包括评估范围界定、互联网访问授权、监控和事件响应,并推动行业标准更新。
评估方应明确测试边界,规范互联网访问使用,加强环境隔离,并建立实时监控和快速响应机制。
无关联。OpenAI明确表示这是独立事件,Hugging Face事件仍在持续更新中。
SEO & GEO 技术探索者,专注于搜索引擎优化和生成式引擎优化。

Circles 利用 OpenAI API 构建 AI 原生的电信技术栈,通过 AI 管家、CareX 多智能体架构和 Xplore IQ 个性化引擎,在新加坡市场实现 22% ARPU 增长和 9% 流失率下降,同时用 Codex 提升内部开发效率 29%。

苹果因沟通失误和基于错误信息的指控起诉 OpenAI,引发业界震动。OpenAI 公布证据反击,揭示苹果在人才流动和商业机密管理上的双重标准。

OpenAI 于 2026 年 8 月推出三款教育插件,分别面向 K-12 教师、大学教师和大学生,旨在通过 ChatGPT Work 和 Codex 平台将智能体能力引入教育场景,实现个性化教学与学习体验,同时确保安全合规与教育者主导权。
获取最新的 SEO 与 GEO 技术资讯。
我们尊重您的隐私,随时可以取消订阅。