Bingdada 技术博客Bingdada 技术博客
首页博客SEOGEOAEOAI工具关于
登录注册
Logo

Bingdada 技术博客

专注于SEO搜索引擎优化和GEO生成式引擎优化以及未来人工智能发展趋势的技术博客

快速链接

  • 首页
  • 博客文章
  • 关于我们

联系方式

  • 398848662@qq.com

订阅我们的 Newsletter,获取最新的 SEO 和 GEO 技术资讯。

© 2024 Bingdada 技术博客. All rights reserved.

首页博客AI人工智能OpenAI 推出安全漏洞悬赏计划,聚焦 AI 滥用与安全风险
OpenAI 推出安全漏洞悬赏计划,聚焦 AI 滥用与安全风险
AI人工智能

OpenAI 推出安全漏洞悬赏计划,聚焦 AI 滥用与安全风险

bingdadabingdada
八月 2, 2026135 次阅读约 4 分钟阅读
快速回答

OpenAI 于2026年3月25日推出全新安全漏洞悬赏计划,聚焦 AI 滥用与安全风险,覆盖智能体风险、专有信息泄露、账户完整性三大领域,作为传统安全漏洞悬赏的补充。

核心要点
  • OpenAI 推出安全漏洞悬赏计划,聚焦 AI 滥用与安全风险
目录

目录

  • OpenAI 推出安全漏洞悬赏计划,聚焦
  • 新计划的核心定位与互补性
  • 计划覆盖范围详解
  • 范围外的内容与专项活动
  • 如何参与
  • 更多相关阅读
  • 关于 Bingdada

OpenAI 推出安全漏洞悬赏计划,聚焦

AI 滥用与安全风险 2026年3月25日,OpenAI 正式宣布启动一项全新的公开安全漏洞悬赏计划(Safety Bug Bounty),旨在识别并应对其产品中潜在的 AI 滥用与安全风险。随着人工智能技术的飞速发展,其被滥用的可能性也在同步增加。OpenAI 的目标是确保其系统在面对可能导致实际伤害的滥用行为时,依然保持安全与可靠。

新计划的核心定位与互补性

这一新计划将作为 OpenAI 现有安全漏洞悬赏计划(Security Bug Bounty)的有力补充。与后者主要关注传统安全漏洞不同,新的安全漏洞悬赏计划专门接受那些虽不符合传统安全漏洞标准,但会带来实质性滥用与安全风险的问题。OpenAI 希望通过此举,继续与安全研究社区紧密合作,共同识别并解决那些超出常规安全范畴但依然构成真实威胁的隐患。 所有提交的问题将由 OpenAI 的安全与安全漏洞悬赏团队进行分类评估,并根据问题范围和归属,在两个计划之间进行合理转派。

计划覆盖范围详解

新的安全漏洞悬赏计划主要聚焦于以下几类与 AI 特定安全场景相关的问题:

1. 智能体风险(Agentic

Risks),包括 MCP(Model Context Protocol) - 第三方提示注入与数据泄露:攻击者通过文本内容成功劫持用户的智能体(包括浏览器、ChatGPT Agent 等类似产品),诱使其执行有害操作或泄露用户敏感信息。该行为需至少达到 50% 的复现率。

  • 大规模违规操作:OpenAI 的智能体产品在其网站上大规模执行被禁止的操作。
  • 其他潜在有害行为:智能体执行了未在上述列表中明确列出但可能造成伤害的操作。有效报告必须指明合理且实质性的伤害风险。
  • MCP 风险测试:必须遵守任何第三方的服务条款。

2. OpenAI

专有信息 - 模型生成内容泄露推理过程相关的专有信息。

  • 暴露其他 OpenAI 专有信息的漏洞。

3. 账户与平台完整性

  • 账户与平台完整性信号的漏洞:如绕过反自动化控制、操纵账户信任信号、规避账户限制/暂停/封禁等。

  • 权限越界问题:允许用户访问超出授权权限的功能、数据或操作的问题,此类问题应提交至 Security Bug Bounty 计划。

范围外的内容与专项活动

需要特别说明的是,通用越狱(jailbreak)行为不在本计划范围内。但 OpenAI 会定期针对特定伤害类型开展私密漏洞悬赏活动,例如 ChatGPT Agent 和 GPT-5 中的生物风险内容问题。研究者可以在这些活动启动时申请参与。 对于上述类别之外的问题,如果研究者能够识别出直接导致用户伤害的缺陷,并提供可操作、可离散修复的步骤,OpenAI 将根据具体情况考虑给予奖励。 反之,那些无法证明有实际安全或滥用影响的通用内容策略绕过行为(例如,仅导致模型使用粗鲁语言或返回搜索引擎易查信息的越狱)不在本计划范围内。

如何参与

有兴趣的研究者可以通过 OpenAI 的安全漏洞悬赏计划页面申请参与。OpenAI 期待与全球的研究者、道德黑客以及安全社区携手合作,共同构建一个安全可靠的 AI 生态系统。 ---

更多相关阅读

  • OpenAI 与 Hugging Face 共同应对安全事件(2026年7月21日)

  • 长周期模型时代的安全与对齐(2026年7月20日)

  • 为什么青少年值得获得安全的 AI 访问(2026年7月16日)


关于 Bingdada

Bingdada 是一个专注 SEO、GEO(生成式引擎优化)与 AEO(答案引擎优化)的内容平台,由资深内容编辑、SEO 技术工程师与 AI 研究专家组成的团队持续运营。我们追踪搜索引擎与生成式 AI 的最新动态,为读者提供准确、实用、可落地的方法论与行业洞察。 编辑团队:内容策划 · 技术编辑 · AI 研究组 网站:bingdada.com © 2026 Bingdada. 保留所有权利。

目录

  • OpenAI 推出安全漏洞悬赏计划,聚焦
  • 新计划的核心定位与互补性
  • 计划覆盖范围详解
  • 范围外的内容与专项活动
  • 如何参与
  • 更多相关阅读
  • 关于 Bingdada
黄金广告位 · 限时招商
广告位招商中

把品牌放进读者的阅读流

文章内广告位,高注意力场景,适合新品发布与活动招募。

商务合作

标签

#OpenAI News#AI 安全#漏洞悬赏#智能体风险#安全研究
bingdada

bingdada

SEO & GEO 技术探索者,专注于搜索引擎优化和生成式引擎优化。

相关文章

OpenAI 让全员用自然语言查数据,企业分析的门槛正在消失
AI人工智能

OpenAI 让全员用自然语言查数据,企业分析的门槛正在消失

OpenAI 在 ChatGPT Work 中推出 Data agent,让员工用自然语言连接企业数据、生成看板并直接行动。本文解析其数据源、语义层与权限设计,并对比国内同类进展。

9月 16约 5 分钟阅读
OpenAI 模型驱动的 Fyxer:AI 行政助理如何做到 90 天留存率 90%
AI人工智能

OpenAI 模型驱动的 Fyxer:AI 行政助理如何做到 90 天留存率 90%

Fyxer 将 OpenAI 模型与 50 万小时行政助理工作流数据结合,用 30-50 个专用模型拆解邮件处理,并通过用户编辑反馈持续优化,实现 90 天留存率 90%、53% 草稿被原样采纳。

9月 15约 7 分钟阅读
当 AI 开始验收自己的代码:Cognition 用 GPT‑6 Astra 重塑软件测试与审查流程
AI人工智能

当 AI 开始验收自己的代码:Cognition 用 GPT‑6 Astra 重塑软件测试与审查流程

Cognition 将 GPT‑6 Astra 用于 Devin 的测试与验证,让 AI 在写完代码后自行运行、录屏并生成报告,目标是把工程师从逐行审查中解放出来,转向更高价值的判断。

9月 14约 6 分钟阅读

订阅我们的 Newsletter

获取最新的 SEO 与 GEO 技术资讯。

我们尊重您的隐私,随时可以取消订阅。

评论 ({count}) (0)

登录后即可参与讨论

登录注册
还没有评论,来抢沙发吧