網路安全領域正快速變遷,威脅行為者將日益利用 AI 以前所未有的速度和規模發動網路攻擊,甚至可能實現完全自主化。隨著這些能力普及,防禦者的準備時間正逐漸縮短。我們的對策是在攻擊者大規模部署攻擊性 AI 能力之前,將尖端情報交到各地受信任的防禦者手中。

我們正在擴展 OpenAI Daybreak 計畫,推出兩種存取層級,旨在為經批准的防禦者提供適合其工作的能力:

Daybreak Blue 提供對尖端通用模型(包括 GPT-5.6 Sol)的存取權限,並針對授權的防禦性安全工作量身定制安全防護措施。對於大多數防禦者而言,這是推薦的起點,支援漏洞發現、安全程式碼審查、惡意軟體分析、事件回應和修補程式驗證等任務。

Daybreak Red 則提供對我們專門訓練的網路安全模型之存取權限,用於授權的漏洞研究、漏洞利用驗證和安全測試。

我們也將推出 GPT-5.6-Cyber,可透過 Daybreak Red 取得。它基於 GPT-5.6 Sol 構建,經過訓練以提升在多項專業網路安全任務(例如尋找零日漏洞和開發漏洞利用鏈)上的能力,並減少對某些高風險、雙重用途網路任務的拒絕。

Daybreak 釋放了先進的網路能力。正如我們之前分享的,GPT-5.6 Sol 在網路安全任務上展現了最先進的效能。在實際應用中,我們部署了系統級安全防護措施來篩選與網路安全相關的請求,以防止濫用,但這些措施也可能阻礙合法的防禦工作。Daybreak Blue 的存取權限移除了這些防護措施,幫助防禦者在實際安全任務中更充分地利用模型,包括事件偵測與回應、調查、漏洞管理和安全評估。

即使沒有系統級防護措施,對於高度雙重用途的網路安全提示詞(例如滲透測試生產系統),GPT-5.6 Sol 仍會拒絕執行。為了解決這個問題,我們訓練了 GPT-5.6-Cyber(可透過 Daybreak Red 存取),以進一步降低拒絕率並提高在特定任務上的效能。GPT-5.6-Cyber 協助受信任的防禦者執行合法的安全活動。

為了衡量 GPT-5.6-Cyber 透過 Daybreak Red 存取所提供的拒絕率降低程度,我們建立了一個內部評估指標(進階網路安全完成率),用來測量模型回應涉及漏洞利用鏈開發、身份驗證繞過、權限提升及其他進階網路安全情境請求的頻率。

GPT-5.6-Cyber 完成了 95.0% 的這些請求,相比之下,GPT-5.6 Sol 僅為 1.5%,而使用 Daybreak Blue 存取時也只有 2.0%。它也比 GPT-5.5-Cyber 完成了更多請求,後者僅完成 57.3% 的請求,這解決了安全研究人員對早期模型持續拒絕的回饋。

下面我們展示了一系列網路安全提示詞,以及來自帶有系統級防護措施的 GPT-5.6 Sol、GPT-5.6 Sol (Daybreak Blue)、GPT-5.5-Cyber (Daybreak Red) 和 GPT-5.6-Cyber (Daybreak Red) 的相關模型回應。