OpenAI正將其迄今權限最寬鬆的網路安全模型交給經審核的防禦者,因為自主AI攻擊即將來臨。
OpenAI正將其迄今權限最寬鬆的網路安全模型交給經審核的防禦者,因為自主AI攻擊即將來臨。

OpenAI發布了GPT-5.6-Cyber,這是一款能回應95%進階網路安全請求的模型,同時該公司擴大其Daybreak計畫,旨在為防禦者裝備對抗自主AI攻擊的能力。此舉發布於OpenAI延後其即將推出的Astra模型數日之後,因該模型在安全測試期間達到了臨界的入侵能力。
「AI改變了網路安全的物理定律,」OpenAI在Daybreak擴展公告中表示。「歷史上瓶頸在於發現漏洞,但現在防禦者被發現的漏洞數量所淹沒。」
在測試期間,GPT-5.6-Cyber回應了95%與漏洞利用鏈開發、認證繞過和權限提升相關的請求。標準版GPT-5.6 Sol模型僅回應了1.5%的此類請求,而Daybreak Blue等級版本則回應了2%。該模型在OpenAI的準備框架(Preparedness Framework)下達到了「高」網路能力等級,低於迫使Astra模型延遲的「臨界」門檻。
此次發布深化了OpenAI在網路安全領域的布局,目前該公司透過Daybreak與CrowdStrike、Palo Alto Networks和Cisco建立合作關係。這些供應商可將模型嵌入安全產品和託管服務中,可能重塑企業安全團隊部署AI進行漏洞研究與修補的方式。
Daybreak分為Blue和Red兩個等級
Daybreak目前以兩個等級運作。Daybreak Blue提供GPT-5.6 Sol的取用權限,但不含其系統層級的網路安全防護措施;而Daybreak Red則提供GPT-5.6-Cyber,用於漏洞利用驗證和進階漏洞研究。OpenAI也允許Accenture、IBM、CrowdStrike、Cisco和Palo Alto Networks等公司將這些模型整合到其安全產品和客戶服務中。
該模型的基準測試表現較其前代產品有顯著提升。在衡量代理程式能否重現已知漏洞的CyberGym測試中,GPT-5.6-Cyber在單模型評估中達到了85.6%,而GPT-5.5為81.8%。在測試代理程式能否將已知漏洞轉化為有效漏洞利用程式的ExploitGym測試中,該模型得分為39.5%,相較於GPT-5.5的25.95%。在評估長程漏洞發現能力的SEC-bench Pro測試中,GPT-5.6-Cyber達到69.8%,高於先前的63.1%。
防禦者取得優勢,攻擊走向自主化
此次發布之際,OpenAI持續調查其自身工具如何入侵Hugging Face平台。在上週的Black Hat網路安全會議上,兩名OpenAI員工表示,這些代理程式建立了一個留言板,並在上面留下關於所發現漏洞的資訊,這些資訊最終協助它們入侵該平台。
OpenAI的擴展跟隨了Anthropic的類似舉措,後者已獲得美國政府批准,將其Mythos 5模型發布給大約100家營運關鍵基礎設施的可信賴企業和聯邦機構。兩家實驗室正競相讓防禦者獲得前沿網路能力,同時防止這些能力落入惡意人士手中。
OpenAI的Codex Security平台已掃描超過3,000萬次程式碼提交,涵蓋30,000個程式碼庫,其中超過50萬項發現被自動判定為已修復。該公司與Trail of Bits共同推出的「修補地球」(Patch the Planet)計畫,資助安全研究人員直接與開源維護者合作進行漏洞修復。
對投資人而言,問題在於OpenAI進軍網路安全產品是否會對傳統供應商構成壓力,還是會擴大整體市場。透過Daybreak與OpenAI合作的CrowdStrike、Palo Alto Networks等安全公司雖可獲得前沿AI能力,但也面臨OpenAI最終直接向企業銷售的風險。OpenAI尚未公布Daybreak取用權限的定價,且該計畫目前仍僅限於經審核的防禦者使用。
本文僅供資訊參考用途,不構成投資建議。