Daybreak
Daybreak 是 OpenAI 面向网络安全的专项计划:把前沿模型、Codex Security、可信访问流程与合作伙伴生态绑在一起,帮助经审批的防御方更快地发现、验证和修复漏洞,而不是把同等能力默认开放给所有用户。它的产品叙事是“防御窗口在收窄”——攻击者也会用 AI 以更高速度与规模(含更自主的路径)开展网络行动,因此要把前沿智能先放到可信防御者手里。
Daybreak 不是单一模型名,也不是公开 API 的默认档位;它是一套身份与信任驱动的访问层,在通用模型护栏之上叠加验证、监控、用途限制与法律声明。治理侧对应 OpenAI 更早推出的 Trusted Access for Cyber(可信网络访问)。
为什么要单独建访问层
公开部署的 GPT-5.6 Sol 在网络安全任务上已经很强,但生产环境会用系统级安全栈拦截高风险网络请求,防止误用。结果是:正当的漏洞研究、渗透测试、补丁验证与事件响应也会被拒答或拖慢。Daybreak 的取舍是:
- 对所有人继续维持更严格的默认网络防护;
- 对通过验证的防御者降低不必要的摩擦,并按工作类型分配不同能力层;
- 用沙箱、审查、监控与范围定义抵消“护栏变松”带来的风险。
这与 Agent Guardrails(Agent 护栏) 中“按风险与可信度差异化访问”的思路一致:不是取消护栏,而是把通用拒答换成身份 + 授权用途 + 运行时控制。
两档访问:Blue 与 Red
2026 年 8 月 10 日,OpenAI 将 Daybreak 扩成明确的两档结构:
| 档位 | 提供什么 | 典型用途 | 推荐对象 |
|---|---|---|---|
| Daybreak Blue | 前沿通用模型(含 GPT-5.6 Sol),去掉系统级网络安全护栏 | 漏洞发现、安全代码审查、恶意软件分析、事件响应、补丁验证、安全评估 | 多数防御者的起点 |
| Daybreak Red | 为网络安全特训的专用模型(当前为 GPT-5.6-Cyber) | 授权下的高级漏洞研究、利用验证、安全测试 / 红队相关工作 | 需要更低拒答率与更强 exploit 能力的专业团队 |
关键区分:
- Blue 不是“阉割版 Red”。它给的是同一代前沿通用模型,只是去掉系统级网络请求拦截;模型自身对高度双用途提示(例如对生产系统做渗透)仍可能拒答。
- Red 才提供在双用途网络任务上进一步降低拒答、并强化特定工作流的专用模型。
内部评测 Advanced Cybersecurity Completion Rate(高级网络安全完成率)衡量模型对利用链开发、认证绕过、提权等高级场景请求的完成比例(厂商内部集,非公开可复现 benchmark):
| 配置 | 完成率 |
|---|---|
| GPT-5.6 Sol(系统级护栏开启) | 1.5% |
| GPT-5.6 Sol + Daybreak Blue | 2.0% |
| GPT-5.5-Cyber(Daybreak Red) | 57.3% |
| GPT-5.6-Cyber(Daybreak Red) | 95.0% |
数字说明:仅去掉系统级护栏(Blue)几乎不改变“会不会答高级双用途请求”;真正拉开差距的是专用 Cyber 模型。OpenAI 也注明评测取各模型公开可用的最高推理档,且 GPT-5.6-Cyber 往往比 Sol 更“写满”推理预算,token 消耗更高。
flowchart TB
U["申请人:个人 / 组织
授权防御工作"] --> V["身份验证 · 账户安全
用途限制 · 法律声明 · 监控"]
V --> B["Daybreak Blue
GPT-5.6 Sol 等
去掉系统级网络护栏"]
V --> R["Daybreak Red
GPT-5.6-Cyber 等
特训 + 更低拒答"]
B --> W1["漏洞发现 / 代码审查
恶意软件 / 事件响应
补丁验证"]
R --> W2["高级漏洞研究
利用验证 / 安全测试"]
W1 --> C["沙箱隔离 · Auto-review
范围权限 · 轨迹监控"]
W2 --> C
产品组件
Daybreak 把能力嵌进已有安全工作流,而不是要求每家企业自建网络 AI 平台:
- Daybreak Access:经审批防御者与合作伙伴申请 Blue / Red 模型访问的入口(身份验证 + 用途与范围控制 + 监控)
- Codex Security:用 agentic 编码流程做发现—验证—修复闭环
- Daybreak Cyber Partner Program:安全厂商、系统集成商与咨询方把模型接入自家产品、托管服务与客户项目(见下节)
- Patch the Planet:与 Trail of Bits 等合作的开源修复加速项目——用前沿模型做发现,再经专家验证、补丁开发/测试、协调披露,维护者保留合并控制权
OpenAI 强调瓶颈已从“能不能找到问题”转向“能不能验证、定优先级、写出补丁并真正落地”——漏洞报告本身不构成防护;保护来自可利用性判断、受影响系统识别、修复方案与生产落地。
官网披露的 Patch the Planet 阶段性数字(厂商自报,随项目滚动更新):约 $1700 万 API 额度与直接支持;41 个开源项目接受 AI 辅助研究与专家审查;858 项待验证/披露问题;263 个已开发并测试的补丁;143 个已被上游维护者接受。
Daybreak Cyber Partner Program
2026 年 8 月文章 Putting frontier cyber models in more trusted hands 把合作伙伴通道写成 Daybreak 的主要分发面:多数组织希望前沿能力落进既有安全产品、托管服务与咨询交付,而不是自建专用网络 AI 程序。合作方带来安全专业能力与客户关系;OpenAI 提供前沿模型与部署工程支持。
两种合作形态
| 形态 | 做法 | 客户拿到什么 |
|---|---|---|
| 产品集成(Product integrations) | 把经批准的能力嵌进有界产品工作流,输出经策展/过滤 | 在已有安全工具里使用能力,不直接持有底层模型访问 |
| 托管 / 顾问服务(Managed services) | 合作方团队 hands-on-keyboard 操作模型,交付结果 | 漏洞发现、验证、修复建议等结果,访问权仍在合作方 |
两种形态的共同点:底层模型访问留在经审批的合作方,不直接转让给终端客户。合作方与组织一起划定每次 engagement 的边界,审查发现,并在采取行动前施加专业判断。
合作方可做的工作类型
视 engagement 而定,伙伴可把 Daybreak Blue 或 Red(经 Daybreak Access)用于:
- 漏洞发现与可利用性验证
- 红队 / 渗透测试(偏 Daybreak Red,需更严格治理)
- 事件响应
- 跨复杂企业系统的修复与落地
Blue 覆盖更广的防御工作流;Red 面向更专业化、更受控的工作(含授权红队与渗透测试)。这与 AI 安全评估语境下的 Red Teaming(红队测试) 不是同一概念:后者测模型失败模式,前者是对目标系统做授权攻防演练。
治理与安全保障
伙伴在“受信任、有治理的 engagement”中使用受控访问模型。常见配套包括:
- 身份验证
- 预定义测试范围(scope)
- 日志与监控
- 人工监督 / 人类审查发现后再行动
项目流程公开写成三步:Connect(评估工作流是否匹配并启动讨论)→ Build(在 OpenAI cyber deployment engineering 支持下构建与验证,含护栏)→ Launch(上线产品或服务)。提交意向不保证入选、模型访问或量产时间表。
已点名的合作方(2026 年 8 月)
安全与服务侧:Accenture、IBM、Capgemini、Cognizant、EY、KPMG、PwC、NCC Group、SpecterOps。
技术 / 产品侧:Palo Alto Networks、CrowdStrike、Cisco、Sophos、Akamai、Fortinet、Cloudflare。
组织侧入口:既可联系现有网络安全提供商,也可通过 OpenAI 销售 / 伙伴申请页加入或采购。
访问与配套安全措施
Blue / Red 面向经批准的个人与组织。控制手段包括身份验证、账户安全、监控、批准用途限制与法律声明;OpenAI 使用政策与其它护栏仍然适用。
2026 年 8 月扩展时额外强调:
- 强推 Auto-review:鼓励 Daybreak 客户把 Codex 从 full-access 切到 auto-review(应用默认与 UI),在越界动作执行前由独立审查拦截破坏性风险。
- 硬件密钥:自 2026 年 9 月 1 日起,Daybreak 个人账户须采用硬件安全密钥。
- 监控与对齐:计划滚动加强监控;对后续 Daybreak 发布优先做对齐训练与测试。
- 使用最佳实践:在受控环境中运行、不接敏感生产与开放互联网;用 scoped permission profiles 限定授权系统与动作;高风险工作流叠加人工监督。
这些措施说明:Daybreak 放开的是模型层拒答与系统级网络分类,不是取消 Agent Sandbox(Agent 沙箱) 与动作前审查。能力越高,运行时边界越要硬。
与 Preparedness 分级的关系
Preparedness Framework(预备框架) 判定的是模型底层网络能力是否达到 High / Critical;Daybreak 解决的是谁能在什么控制下使用哪一档能力。GPT-5.6 Sol 与 GPT-5.6-Cyber 均被判定为网络安全 High、未达 Critical;与可能触及 Critical 的 Astra 形成对照。Daybreak 扩展发布于 Astra Critical 预告数日之后,可视为同一策略的另一面:一边对逼近 Critical 的下一代模型收紧内部控制,一边把已达 High 的防御能力更系统地交给可信防御者。
相关词条
- GPT-5.6-Cyber — Daybreak Red 当前的专用网络安全模型
- GPT-5.6 — Blue 档使用的前沿通用模型系列
- Preparedness Framework(预备框架) — High / Critical 能力分级
- Astra — 可能触及 Critical、促使整体控制上移的下一代模型
- Agent Guardrails(Agent 护栏) — 差异化访问与分层防护的通用概念
- Auto-review — Daybreak 推荐的 Codex 越界审查路径
- Agent Sandbox(Agent 沙箱) — 安全工作流的隔离执行基础
- ExploitGym — 用于衡量专用模型利用能力的 benchmark
- Codex — Daybreak 中的 agentic 安全工作台