OpenAI推出GPT-5.6-Cyber用于安全研究

The Decoder··作者 Matthias Bastian

关键信息

根据OpenAI的说法,GPT-5.6-Cyber基于GPT-5.6 Sol,并针对大多数其他模型会拒绝的敏感安全问题进行了优化,包括漏洞利用链开发和权限提升场景。OpenAI表示,Daybreak访问需要身份验证、账户安全控制、监控、法律声明以及隔离沙箱工作流,并且从2026年9月1日起,所有Daybreak账户都必须使用硬件安全密钥。

资讯摘要

OpenAI扩大了其Daybreak网络安全项目,新增两个层级,并推出新模型GPT-5.6-Cyber,目标是帮助防御者在攻击者大规模利用之前更早发现漏洞。该项目分为Daybreak Blue和Daybreak Red两个方向。Daybreak Blue提供带有安全防护的GPT-5.6 Sol,面向漏洞检测、恶意软件分析和事件响应等防御工作。Daybreak Red则面向经过授权的安全研究人员,用于漏洞研究、漏洞利用验证和渗透测试。

OpenAI表示,进入这两个层级都需要身份验证、更强的账户安全措施、监控和法律声明。公司还建议在隔离的沙箱环境中运行安全工作流,并在Codex中使用Auto-Review模式,对需要提升权限的操作先进行检查。到2026年9月1日,所有Daybreak账户还必须使用硬件安全密钥。

GPT-5.6-Cyber可通过Daybreak Red使用,它基于GPT-5.6 Sol,但专门针对进攻性安全任务进行了训练。OpenAI称,该模型很少拒绝其他模型默认会屏蔽的安全相关请求,包括涉及漏洞利用链、认证绕过和权限提升的内容。在OpenAI内部基准“Advanced Cybersecurity Completion Rate”中,GPT-5.6-Cyber据称能回答95%的相关问题,而开启安全措施的GPT-5.6 Sol仅为1.5%,Daybreak Blue为2%,GPT-5.5-Cyber为57.3%。

OpenAI还举了一个测试案例:模型需要为一个内部管理面板开发WebSocket认证绕过。只有Daybreak Red上的GPT-5.6-Cyber给出了可工作的漏洞利用代码,其他版本都拒绝作答。在ExploitGym基准上,GPT-5.6-Cyber在把已知漏洞转化为可用利用代码方面,也优于GPT-5.6 Sol和GPT-5.5-Cyber。

OpenAI还表示,他们已经把GPT-5.6-Cyber用于真实世界的漏洞研究。一次案例中,该模型分析了Chrome的V8 JavaScript引擎,发现了两个此前未知的漏洞,这两个漏洞可以被串联起来,造成内存破坏并绕过V8堆沙箱。Google在协调披露后修复了这些问题,并分配了CVE-2026-15903。

OpenAI还称,该模型在一款“流行的移动操作系统”中发现了至少五个漏洞。其中一个漏洞链可以让应用把自己受限的权限提升到完整管理员权限,从而接管设备。整体来看,这项公告把GPT-5.6-Cyber定位为既能辅助防御,也能在严格控制下支持进攻性研究的工具,回应了OpenAI对AI辅助网络攻击将变得更自主、更普遍的预期。

OpenAI推出GPT-5.6-Cyber用于安全研究

资讯正文

OpenAI推出GPT-5.6-Cyber,帮助防御者在攻击者之前发现漏洞

要点

- OpenAI正在扩展其 Daybreak 网络安全项目,新增两个访问层级和一个名为 GPT-5.6-Cyber 的专用 AI 模型,旨在帮助安全专业人员识别漏洞并在早期阶段开发利用代码。

- 该项目分为两个方向:Daybreak Blue 侧重于恶意软件分析等防御任务,而 Daybreak Red 则面向进攻性安全研究。

- 通过 Red 层级,用户可以访问 GPT-5.6-Cyber;这是一款专门为进攻性安全用途训练的模型,能够回应几乎所有通常会被其他 AI 模型拦截的敏感安全查询。

OpenAI 正在扩展其 Daybreak 项目,新增两个访问层级以及一个名为 GPT-5.6-Cyber 的专用模型。该模型旨在帮助防御者在攻击者能够大规模部署由 AI 驱动的进攻工具之前,尽早发现漏洞并构建利用代码。

OpenAI 表示,威胁行为者将越来越多地利用 AI 发动网络攻击,包括完全自主化的攻击。防御者可用于准备的窗口正在变得越来越短。讽刺的是,最好的例子恰恰来自 OpenAI 自身:其自家模型在内部消息板上经过数周的智能体式谋划后,意外入侵了 Hugging Face 以及其他服务。

Daybreak 的目的是让防御者抢占先机。该项目现在有两个访问层级。Daybreak Blue 让用户能够访问 GPT-5.6 Sol,并针对经授权的防御工作提供定制化防护,例如漏洞检测、恶意软件分析和事件响应。Daybreak Red 面向从事漏洞研究、利用验证和渗透测试的安全研究人员。

要进入任一层级,都需要进行身份验证、采取账户安全措施、接受监控以及提交法律声明。自 2026 年 9 月 1 日起,所有 Daybreak 账户都必须使用硬件安全密钥。OpenAI 还建议在隔离的沙箱环境中运行安全工作流,并在 Codex 中使用 Auto-Review 模式,在需要提升权限的操作执行前进行检查。

GPT-5.6-Cyber 能回答其他模型会拦截的 95% 敏感安全查询

这款新的 GPT-5.6-Cyber 模型可通过 Daybreak Red 层级使用。它基于 GPT-5.6 Sol,并经过专门训练,以更好地完成寻找零日漏洞和构建漏洞利用链等任务。OpenAI 表示,与其他默认拦截安全相关查询的模型相比,该模型很少拒绝这类请求。

在一项名为“Advanced Cybersecurity Completion Rate”的内部基准测试中,GPT-5.6-Cyber 能够回答 95% 的查询,涵盖漏洞利用链开发、认证绕过和权限提升等场景。开启安全措施的 GPT-5.6 Sol 仅达到 1.5%。在 Daybreak Blue 下,它达到 2%。上一代模型 GPT-5.5-Cyber 的成绩为 57.3%。

在一项特定测试中,这些模型必须为一个内部管理面板开发 WebSocket 身份验证绕过。只有 Daybreak Red 上的 GPT-5.6-Cyber 产出了可用的利用代码。其他所有变体都拒绝回应。在 ExploitGym 上——这是一个衡量模型将已知漏洞转化为可用 exploit 能力的基准——GPT-5.6-Cyber 的表现优于 GPT-5.6 Sol 和 GPT-5.5-Cyber。

该模型已经发现了两个未知的 Chrome 漏洞

OpenAI 还将 GPT-5.6-Cyber 用于现实世界的漏洞研究。该公司表示,这个模型分析了 V8,也就是 Chrome 的 JavaScript 引擎,并发现了两个此前未知的漏洞,这两个漏洞可以串联起来破坏内存,并绕过 V8 堆沙箱。Google 在协调披露后修复了这些缺陷,并将其编号为 CVE-2026-15903。

据称,GPT-5.6-Cyber 还在一款“流行的移动操作系统”中发现了至少五个漏洞。其中一个是由一串缺陷组成的链条,允许应用将其通常受限的访问权限提升为完整的管理员权限,从而接管设备。OpenAI 正在与 Daybreak 伙伴以及开源社区合作,披露并修复这些问题。

根据 OpenAI 的 Preparedness Framework,GPT-5.6-Cyber 在网络安全能力方面被评为“High”,但尚未达到“Critical”门槛。不过,最近发布的 Astra 模型“有可能”会达到 Critical 级别。鉴于 GPT-5.6-Cyber 已经是一个专门优化的模型,却仍未达到 Critical,可以看出发展趋势已经很明确:随着每一代新模型的出现,AI 网络安全能力都在快速攀升。

来源与参考

  1. 原始链接
  2. OpenAI launches GPT-5.6-Cyber to help defenders find vulnerabilities before attackers do

收录于 2026-08-11