Daybreak:保护全球每个组织的工具
Daybreak: Tools for securing every organization in the world
OpenAI 扩展了 Daybreak 项目,旨在加速易受攻击软件的修补。发布了 Codex Security 插件更新,该插件已扫描超过 30,000 个代码库中的 3000 万次提交,并自动确定超过 50 万项发现已修复。推出了 GPT-5.5-Cyber 完整版本,在 CyberGym 上达到 85.6% 的 SOTA 性能(GPT-5.5 为 81.8%),并在 ExploitGym 和 SEC-bench Pro 上优于 GPT-5.5。启动了 Daybreak 网络安全合作伙伴计划,与 Accenture、CrowdStrike 等 28 家机构合作。与 Trail of Bits 共同发起 Patch the Planet 项目,已有超过 30 个开源项目(包括 cURL、Go、Python)承诺参与,旨在帮助维护者从发现问题转向修复问题。
我们正在扩展 Daybreak,以帮助普及以机器速度修补易受攻击软件的能力。例如,我们已经应用我们的模型来发现并生成针对主流浏览器、网络基础设施以及 FreeBSD 和 Linux 内核等操作系统中 关键漏洞(opens in a new window) 的补丁。为了扩大这些能力的影响:
- Codex Security: 我们正在发布 Codex Security 插件 的更新,该插件将我们从内部和客户使用模型中获得的经验转化为一个解决方案,以加速发现和修补现有系统中的漏洞,并自动防止新漏洞进入生产环境。
- GPT‑5.5‑Cyber: 在仅限许可的初始预览之后,我们通过持续向受信任的防御者进行有限发布,推出了 GPT‑5.5‑Cyber 的完整版本。该模型在 CyberGym 上达到了新的 SOTA 性能,达到 85.6%,而 GPT‑5.5 为 81.8%。
- Daybreak 网络安全合作伙伴计划:使安全合作伙伴能够通过我们最强大的模型,在其产品和服务中提供可信访问,从而将收益扩展到更多组织。
- Patch the Planet:一项与 Trail of Bits 共同发起,并与 HackerOne、Calif、研究人员和维护者合作的项目,旨在帮助广泛使用的开源项目从发现问题转向修复问题。
- 已有超过 30 个开源项目承诺参与,初始参与者包括 cURL、Go、Python、Sigstore 和 pyca/cryptography。
- 通过 Patch the Planet,我们与研究人员、维护者、企业和合作伙伴合作,通过适当的访问权限、治理和人工监督,为防御者提供强大的网络能力。点击 此处(opens in a new window) 听听 Clint 和 Dan 的看法。
网络防御的转折点
AI 已经改变了网络安全的格局。前沿 AI 模型正在加速漏洞发现。历史上,瓶颈一直是 发现 漏洞,但现在防御者被发现的漏洞数量所淹没。相反,现在的瓶颈变成了 修补 漏洞。
多年来,发现严重漏洞需要罕见的技术专长、时间以及对复杂系统的深入了解。现在,模型可以浏览大型代码库、推理攻击路径、验证假设,并揭示可能隐藏的安全问题。防御者绝对需要获得这些能力,也需要工具来修复我们现在能够发现的问题,抢在攻击者之前。
漏洞报告本身并不能保护任何人。价值来自于验证问题、理解其影响、开发和测试补丁、协调披露以及帮助团队部署修复。我们正在与合作伙伴一起投资改进这些后续步骤,以增强防御者的能力,并将模型能力转化为现实世界风险的降低。
前沿防御能力不应集中在少数人手中。软件触及生活的方方面面,从关键基础设施到商业应用和政府网络。随着 AI 改变漏洞发现的节奏,各地的防御者都需要民主化地访问这些模型,以便在攻击者识别和滥用这些缺陷之前,发现、修复并保护他们的基础设施。
Daybreak 整合了 OpenAI 模型的前沿网络能力、网络安全可信访问、Codex Security 工作流以及生态系统合作伙伴,以帮助经批准的防御者验证漏洞、确定风险优先级、生成和测试修复,并在现有的安全和开发工作流中生成证据。我们的目标是为组织提供在网络安全威胁形势持续加速的情况下保持安全所需的工具。
从发现问题到修复问题:Codex Security
自 3 月份以研究预览形式推出 Codex Security cloud 以来,它已扫描了超过 30,000 个代码库中的超过 3000 万次提交;人工审查员已手动标记超过 70,000 个发现为已修复,并且超过 500,000 个发现已被自动确定为已修复。
这就是现在必须进行修补的规模。

我们围绕一个简单的理念构建了 Codex Security:通过直接集成到 Codex 中,为每位软件开发人员配备一名安全工程师。Codex Security 不仅仅是生成警报,它会理解你团队的代码及其威胁模型(如果不存在则生成一个),识别可能的漏洞,确定受影响的代码是否可达,收集证据以提供验证步骤,开发有针对性的补丁,并验证结果。人类仍然控制着要调查哪些发现、应用哪些更改以及共享哪些信息。
今天,我们发布了 Codex Security 插件 的更新,该更新支持开箱即用的防御性安全工作流。开发人员可以运行深度扫描或审查最近的更改,生成包含严重性、受影响的代码位置、验证证据和修复指导的报告,追踪攻击路径,构建威胁模型,验证发现,并生成特定于代码库的补丁以供审查。

设置扫描以覆盖整个代码库、代码库的子集或特定的更改或提交。
该 插件 还可以对来自扫描器、安全公告、漏洞赏金报告或工单系统的现有发现进行分类和验证,然后大规模自动化补丁生成,以快速关闭积压的漏洞。当 Codex Security 完成扫描时,它还可以导出到现有的漏洞管理系统,或集成到使用 SARIF 文件、CodeQL 查询等的工具中。该插件使这些能力更易于访问,以支持使用 Codex CLI 的自动化流水线,或集成到 Codex 应用中的开发人员工作流中。
更新 GPT‑5.5‑Cyber:能力与许可性的结合
我们正在发布 GPT‑5.5‑Cyber 的更新,该模型在高级、授权的网络安全工作中既更具许可性,也更具能力。
我们最初的 GPT‑5.5‑Cyber 预览版主要旨在减少专业工作流中不必要的拒绝。此次更新更进一步。它是我们目前用于发现和帮助修补软件漏洞的最强模型,同时保留了 GPT‑5.5 的通用智能以及在长而复杂的任务中工作的能力。
该模型可以在大型代码库中进行更深入的分析:识别与安全相关的组件,追踪易受攻击的代码是否可达,在受控环境中验证可能的问题,开发和测试补丁,并为人工审查准备证据。目标是帮助防御者完成完整的修复循环——而不仅仅是产生更多的发现。
在衡量 agent 是否能在软件环境中复现已知漏洞的 CyberGym 上,更新后的 GPT‑5.5‑Cyber 在单模型评估中达到了 85.6%,而 GPT‑5.5 为 81.8%。这是我们测量到的单个模型在 CyberGym 上的最高分数。
GPT‑5.5‑Cyber 在两个要求苛刻的现实世界安全基准测试中也优于 GPT‑5.5:在测试 agent 能否将已知漏洞转化为可实现未授权代码执行的有效利用的 ExploitGym 上,得分为 39.5% 对比 25.95%。在评估跨复杂软件目标的长期漏洞发现和概念验证生成的 SEC-bench Pro 上,GPT‑5.5‑Cyber 达到了 69.8%,而 GPT‑5.5 为 63.1%。
基准测试只是故事的一部分。在实践中重要的是模型能否发现真实漏洞,将可操作的问题与噪音区分开来,并帮助防御者安全地落地修复。随着协调披露的结束,我们正在继续评估模型在复杂仓库和真实修复工作流上的表现。
我们一直与美国政府就我们的网络安全方法进行持续对话,包括今天的公告以及我们为即将发布的模型所做的准备。这包括继续与 AI 标准与创新中心(CAISI)就 GPT‑5.5 和 5.5-Cyber 的部署前测试进行合作,并与国家网络总监办公室(ONCD)和科技政策办公室(OSTP)合作,以实施最近的 行政命令(opens in a new window) 及相关行业标准。
对于大多数防御者来说,带有网络安全可信访问和 Codex Security 的 GPT‑5.5 仍然是正确的起点。GPT‑5.5‑Cyber 适用于经过验证的防御者,其授权工作需要我们最先进的网络能力和更许可的行为,并配合更强的验证、监控、范围控制和审查。在 Daybreak 的早期工作中,GPT‑5.5 和 Codex Security 已经帮助防御者识别和验证了广泛使用系统中的漏洞,包括 Firefox、V8、Safari、OpenBSD、FreeBSD 和 HTTP/2 的实现。
与安全生态系统合作
作为此次扩展的一部分,我们还与领先的安全软件和服务提供商共同推出了 OpenAI Daybreak 网络安全合作伙伴计划 。通过该计划,参与的合作伙伴可以在其向客户提供的安全产品和服务中使用带有网络安全可信访问的 GPT‑5.5——这是我们用于大多数防御性网络安全工作流的主要模型。这使他们的客户能够受益于该模型的防御能力,并使他们的软件更具弹性,但将模型的直接访问权限保留在参与的合作伙伴手中。

我们还将与项目合作伙伴合作,继续加强在安全生态系统中负责任地部署这些能力所需的安全保障、监控和滥用预防标准。我们正在与一组初始 合作伙伴 一起推出此项目,并计划在未来几个月内继续扩展到更多组织。
Patch the Planet:在开源中落地修复
Patch the Planet 是一项旨在帮助维护者从发现问题转向修复问题的倡议。该项目与 Trail of Bits 共同发起,并与 HackerOne 和 Calif 合作,我们资助专业的安全研究人员,并为他们配备 Codex Security 和我们的先进模型,以便直接与开源维护者合作。
开源软件为跨行业的产品、公共服务、开发人员工具和关键基础设施提供动力。广泛使用的网络库中的漏洞可能影响数千个下游系统。然而,许多此类项目由非常小的团队维持,时间和资金有限。Linux 基金会和哈佛的研究(opens in a new window) 发现,其研究的广泛使用的项目中,94% 的项目中,负责一年内添加的 90% 以上代码的开发者不到十人。
随着 AI 使得更快地发现和修补更多漏洞成为可能,它也为维护者创造了更多工作,他们需要筛选数千份报告,其中许多是低质量的误报。维护者不应该在收到更多报告的同时却没有额外的能力来修复它们。这就是为什么 Patch the Planet 围绕专家人工安全审查构建。
每次合作都始于我们的安全研究人员与他们正在帮助的维护者之间的咨询。维护者定义他们的优先级、偏好和既定的披露流程。然后,Patch the Planet 的安全研究人员端到端地管理工作——在将漏洞和补丁提交给维护者之前进行验证和去重,从而显著减轻维护者的负担并加快修复速度。
参与的项目将获得 ChatGPT Pro、Codex Security 的条件访问权限以及用于核心开发、维护者自动化和发布工作流的 API 额度。
在多个项目上进行的为期五天的初始冲刺中,发现了数百个待审查的问题,合并了数十个补丁(还有更多正在进行中),并构建了可重用的模糊测试、变体分析、差异测试和基于规范的测试工作流。你可以在 Trail of Bits 博客上阅读更多内容 此处(opens in a new window)。
发现漏洞很重要,但保护世界的是落地修复,而这需要协作和社区支持。
保护关键基础设施和敏感系统
我们还在与世界各国政府和机构密切合作,以提升他们的防御性网络安全能力并保护关键基础设施。随着我们为日益具备网络能力的 AI 模型做准备,我们一直在与美国政府和相关联邦机构密切合作。在过去的一个月里,我们已经与澳大利亚、加拿大、法国、德国、日本、韩国以及 ENISA 等欧盟机构建立了网络安全可信访问合作伙伴关系。我们与英国政府在网络安全、测试与评估以及其他共同感兴趣的领域也建立了日益增长且值得信赖的合作伙伴关系。
我们计划直接与符合条件的关基设施运营商(包括政府网络)合作,为他们运营的系统量身定制安全保障措施。这项工作的重点是让先进 AI 对防御者更有用,同时使恶意行为者更难造成现实世界的伤害。
我们还将与企业客户和受信任的合作伙伴合作,纳入关于他们运营或保护的特定系统的更广泛背景和标识符,以加强我们的网络安全保障措施和防止涉及关键服务的有害网络活动的能力。
下一步是什么
Daybreak 整合了模型、Codex Security、Patch the Planet、专家研究人员、维护者、安全合作伙伴、关键基础设施运营商和可信访问控制,以帮助人类防御者迎接挑战。
公共和私营部门的组织可以与 OpenAI Daybreak 合作,识别、验证和修复他们构建和依赖的软件中的漏洞。开发者和维护者可以在他们拥有的代码上运行扫描,审查发现,并帮助落地修复。安全合作伙伴和从业者可以使用我们的前沿模型来加强他们的防御工具,并快速将这些能力带给更多组织。
目标是超越使用模型发现更多漏洞,迈向一个拥有更安全软件和网络韧性的世界。