Bingdada 技术博客Bingdada 技术博客
首页博客SEOGEOAI工具关于
登录注册
Logo

Bingdada 技术博客

专注于SEO搜索引擎优化和GEO生成式引擎优化以及未来人工智能发展趋势的技术博客

快速链接

  • 首页
  • 博客文章
  • 关于我们

联系方式

  • 398848662@qq.com

订阅我们的 Newsletter,获取最新的 SEO 和 GEO 技术资讯。

© 2024 Bingdada 技术博客. All rights reserved.

首页博客AI人工智能OpenAI 推出安全漏洞悬赏计划,聚焦 AI 滥用与安全风险
OpenAI 推出安全漏洞悬赏计划,聚焦 AI 滥用与安全风险
AI人工智能

OpenAI 推出安全漏洞悬赏计划,聚焦 AI 滥用与安全风险

bingdadabingdada
八月 2, 20266 次阅读约 4 分钟阅读
快速回答

OpenAI 于2026年3月25日推出全新安全漏洞悬赏计划,聚焦 AI 滥用与安全风险,覆盖智能体风险、专有信息泄露、账户完整性三大领域,作为传统安全漏洞悬赏的补充。

核心要点
  • OpenAI 推出安全漏洞悬赏计划,聚焦 AI 滥用与安全风险
目录

目录

  • OpenAI 推出安全漏洞悬赏计划,聚焦 AI 滥用与安全风险
  • 新计划的核心定位与互补性
  • 计划覆盖范围详解
  • 范围外的内容与专项活动
  • 如何参与
  • 更多相关阅读

OpenAI 推出安全漏洞悬赏计划,聚焦 AI 滥用与安全风险

2026年3月25日,OpenAI 正式宣布启动一项全新的公开安全漏洞悬赏计划(Safety Bug Bounty),旨在识别并应对其产品中潜在的 AI 滥用与安全风险。随着人工智能技术的飞速发展,其被滥用的可能性也在同步增加。OpenAI 的目标是确保其系统在面对可能导致实际伤害的滥用行为时,依然保持安全与可靠。

新计划的核心定位与互补性

这一新计划将作为 OpenAI 现有安全漏洞悬赏计划(Security Bug Bounty)的有力补充。与后者主要关注传统安全漏洞不同,新的安全漏洞悬赏计划专门接受那些虽不符合传统安全漏洞标准,但会带来实质性滥用与安全风险的问题。OpenAI 希望通过此举,继续与安全研究社区紧密合作,共同识别并解决那些超出常规安全范畴但依然构成真实威胁的隐患。

所有提交的问题将由 OpenAI 的安全与安全漏洞悬赏团队进行分类评估,并根据问题范围和归属,在两个计划之间进行合理转派。

计划覆盖范围详解

新的安全漏洞悬赏计划主要聚焦于以下几类与 AI 特定安全场景相关的问题:

1. 智能体风险(Agentic Risks),包括 MCP(Model Context Protocol)

  • 第三方提示注入与数据泄露:攻击者通过文本内容成功劫持用户的智能体(包括浏览器、ChatGPT Agent 等类似产品),诱使其执行有害操作或泄露用户敏感信息。该行为需至少达到 50% 的复现率。
  • 大规模违规操作:OpenAI 的智能体产品在其网站上大规模执行被禁止的操作。
  • 其他潜在有害行为:智能体执行了未在上述列表中明确列出但可能造成伤害的操作。有效报告必须指明合理且实质性的伤害风险。
  • MCP 风险测试:必须遵守任何第三方的服务条款。

2. OpenAI 专有信息

  • 模型生成内容泄露推理过程相关的专有信息。
  • 暴露其他 OpenAI 专有信息的漏洞。

3. 账户与平台完整性

  • 账户与平台完整性信号的漏洞:如绕过反自动化控制、操纵账户信任信号、规避账户限制/暂停/封禁等。
  • 权限越界问题:允许用户访问超出授权权限的功能、数据或操作的问题,此类问题应提交至 Security Bug Bounty 计划。

范围外的内容与专项活动

需要特别说明的是,通用越狱(jailbreak)行为不在本计划范围内。但 OpenAI 会定期针对特定伤害类型开展私密漏洞悬赏活动,例如 ChatGPT Agent 和 GPT-5 中的生物风险内容问题。研究者可以在这些活动启动时申请参与。

对于上述类别之外的问题,如果研究者能够识别出直接导致用户伤害的缺陷,并提供可操作、可离散修复的步骤,OpenAI 将根据具体情况考虑给予奖励。

反之,那些无法证明有实际安全或滥用影响的通用内容策略绕过行为(例如,仅导致模型使用粗鲁语言或返回搜索引擎易查信息的越狱)不在本计划范围内。

如何参与

有兴趣的研究者可以通过 OpenAI 的安全漏洞悬赏计划页面申请参与。OpenAI 期待与全球的研究者、道德黑客以及安全社区携手合作,共同构建一个安全可靠的 AI 生态系统。


更多相关阅读

  • OpenAI 与 Hugging Face 共同应对安全事件(2026年7月21日)
  • 长周期模型时代的安全与对齐(2026年7月20日)
  • 为什么青少年值得获得安全的 AI 访问(2026年7月16日)

目录

  • OpenAI 推出安全漏洞悬赏计划,聚焦 AI 滥用与安全风险
  • 新计划的核心定位与互补性
  • 计划覆盖范围详解
  • 范围外的内容与专项活动
  • 如何参与
  • 更多相关阅读
黄金广告位 · 限时招商
广告位招商中

把品牌放进读者的阅读流

文章内广告位,高注意力场景,适合新品发布与活动招募。

商务合作

标签

#OpenAI News#AI 安全#漏洞悬赏#智能体风险#安全研究
bingdada

bingdada

SEO & GEO 技术探索者,专注于搜索引擎优化和生成式引擎优化。

相关文章

OpenAI如何用AI提升销售效率与客户成功
AI人工智能

OpenAI如何用AI提升销售效率与客户成功

OpenAI销售团队规模一年增长三倍,通过构建GTM Assistant智能助手,将顶尖销售经验系统化,实现销售生产力提升20%,让销售代表每周多出一天时间专注于客户关系。

8月 4约 5 分钟阅读
OpenAI 正式发布 Sora:负责任地开启 AI 视频生成新时代
AI人工智能

OpenAI 正式发布 Sora:负责任地开启 AI 视频生成新时代

OpenAI 正式发布 AI 视频生成模型 Sora,通过水印溯源、肖像权控制、青少年保护、内容过滤等多维安全策略,在推动视频创作创新的同时,构建了负责任的 AI 应用框架。

8月 4约 6 分钟阅读
Sora 2 正式发布:AI视频生成迎来GPT-3.5时刻
AI人工智能

Sora 2 正式发布:AI视频生成迎来GPT-3.5时刻

OpenAI 发布 Sora 2,视频生成模型迎来 GPT-3.5 时刻。新模型在物理准确性、可控性上大幅提升,支持同步音效和对话,并推出基于‘角色’功能的社交 iOS 应用。

8月 4约 5 分钟阅读

订阅我们的 Newsletter

获取最新的 SEO 与 GEO 技术资讯。

我们尊重您的隐私,随时可以取消订阅。

评论 ({count}) (0)

登录后即可参与讨论

登录注册
还没有评论,来抢沙发吧