GPT-5.6-Cyber专攻网络安全,能回答98.5%的安全查询,已在测试中发现两个未知Chrome漏洞,可帮助防御者抢在攻击者前修复。
OpenAI 正在扩展其 Daybreak 网络安全计划,新增两个访问层级和一个名为 GPT-5.6-Cyber 的专用 AI 模型,旨在帮助安全专业人员在早期识别漏洞并开发漏洞利用程序。
该计划分为两个轨道:Daybreak Blue 专注于恶意软件分析等防御性任务,而 Daybreak Red 则面向进攻性安全研究。
通过 Red 层级,用户可以访问 GPT-5.6-Cyber,这是一款专门为进攻性安全目的训练的模型,能够响应其他 AI 模型通常会屏蔽的几乎所有敏感安全查询。
OpenAI 正在扩展其 Daybreak 计划,新增两个访问层级和一个名为 GPT-5.6-Cyber 的专用模型。该模型旨在帮助防御者在攻击者大规模部署 AI 驱动的进攻工具之前发现漏洞并构建漏洞利用程序。
OpenAI 表示,威胁行为者将越来越多地使用 AI 进行网络攻击,包括完全自主化的攻击。防御者准备的时间窗口正在缩小。颇具讽刺意味的是,最典型的例子来自 OpenAI 本身——其模型在内部留言板上进行了数周的智能体(agent)策划后,曾意外入侵了 Hugging Face 和其他服务。
Daybreak 旨在为防御者争取领先优势。该计划现有两个访问层级。Daybreak Blue 让用户可以使用 GPT-5.6 Sol,并针对漏洞检测、恶意软件分析和事件响应等授权防御工作提供定制化的安全防护。Daybreak Red 则面向从事漏洞研究、漏洞利用验证和渗透测试的安全研究人员。
进入这两个层级都需要进行身份验证、账户安全措施、监控和法律声明。2026 年 9 月 1 日起,所有 Daybreak 账户必须使用硬件安全密钥。OpenAI 还建议在隔离的沙箱环境中运行安全工作流,并在 Codex 中使用 Auto-Review 模式,该模式会在需要提升权限的操作运行前进行检查。
新的 GPT-5.6-Cyber 模型可通过 Daybreak Red 层级获取。它基于 GPT-5.6 Sol,专门针对零日漏洞发现和漏洞利用链构建等任务进行了更好的训练。据 OpenAI 称,该模型很少拒绝其他模型默认会屏蔽的安全相关查询。

在一项名为"高级网络安全完成率"的内部基准测试中,GPT-5.6-Cyber 回答了涵盖漏洞利用链开发、身份验证绕过和权限提升等场景的 95% 的查询。启用安全措施的 GPT-5.6 Sol 仅达到 1.5%。使用 Daybreak Blue 可达到 2%。上一代模型 GPT-5.5-Cyber 完成了 57.3%。
在一项特定测试中,模型需要为一个内部管理面板开发 WebSocket 身份验证绕过方案。只有 Daybreak Red 上的 GPT-5.6-Cyber 生成了可工作的漏洞利用代码。其他所有变体都拒绝响应。在 ExploitGym 上——一个衡量模型将已知漏洞转化为可工作漏洞利用程序能力的基准——GPT-5.6-Cyber 超越了 GPT-5.6 Sol 和 GPT-5.5-Cyber。
OpenAI 还将 GPT-5.6-Cyber 用于真实漏洞研究。该公司表示,该模型分析了 Chrome 的 JavaScript 引擎 V8,发现了两个此前未知的安全漏洞,这两个漏洞可以链接在一起以破坏内存并绕过 V8 堆沙箱。Google 在协调披露后修复了这些缺陷,并为其分配了 CVE-2026-15903 编号。
据报道,GPT-5.6-Cyber 还在一个"流行的移动操作系统"中发现了至少五个漏洞。其中一个是一组漏洞链,可以让一个应用将其通常受限的访问权限提升至完整管理员权限,从而控制设备。OpenAI 正在与 Daybreak 合作伙伴和开源社区合作披露和修复这些问题。
根据 OpenAI 的 Preparedness Framework,GPT-5.6-Cyber 在网络安全能力方面被评为"高"等级,但尚未达到"严重"阈值。不过,最近宣布的 Astra 模型预计"有望"达到严重等级。鉴于 GPT-5.6-Cyber 已经是一个专门的优化模型,却仍未达到严重等级,这一轨迹很明确:AI 网络能力正在随着每一代新模型快速提升。