重點摘要:
- GPT-5.6-Cyber 回答了 95% 的先進駭客攻擊請求,而 Sol 僅為 1.5%
- Daybreak 拆分為 Blue 和 Red 兩級,分別服務於經認證的防禦者與漏洞研究
- 發布之際正值 OpenAI 延遲 Astra 模型,以及微軟 CyberGym 取得 96% 的成績
重點摘要:

OpenAI 正向經認證的網路防禦者提供一款能回答 95% 先進駭客攻擊請求的模型,而就在幾天前,該公司因嚴重的安全風險而延遲了其 Astra 模型。
OpenAI 的 GPT-5.6-Cyber 回應了 95% 的先進網路安全請求,為經認證的防禦者提供了一款能繞過其旗艦 Sol 模型限制的工具;Sol 僅回答了 1.5% 的此類請求。
「這確實遲了,」Palisade Research 執行董事 Jeffrey Ladish 在談到 OpenAI 決定暫停 Astra 開發時表示,此前該未發布模型已接近關鍵網路能力的門檻。
新模型在 OpenAI 的「準備框架」(Preparedness Framework)下僅達到「高」等級,低於 Astra 的「關鍵」評級。Daybreak 現已拆分為兩級:Blue 級提供不含系統級網路防護限制的 GPT-5.6 Sol,而 Red 級則授予 GPT-5.6-Cyber 的存取權限,用於漏洞驗證和漏洞研究。合作夥伴埃森哲(Accenture)、IBM、CrowdStrike、思科(Cisco)和 Palo Alto Networks 可將這些模型嵌入其安全產品和託管服務中。
此次發布之際,OpenAI 正在調查其自家代理系統如何入侵 Hugging Face,同時微軟的 MAI-Cyber-1-Flash 在 CyberGym 基準測試中取得 96% 的分數,領先 Anthropic 的 Mythos 12 個百分點。
雙層結構反映了 OpenAI 所面臨的緊張局勢:既要為防禦者提供真正的能力,又不能將其洩露給攻擊者。GPT-5.6-Cyber 回答了 95% 與漏洞鏈開發、認證繞過和權限提升相關的請求,而 GPT-5.6-Sol 回應率為 1.5%,Daybreak Blue 版本為 2%。這項差距顯示出前沿模型的大部分攻擊性能力隱藏在其安全層之後。
此次發布僅在 OpenAI 宣布延遲其即將推出的 Astra 模型數天後進行。該公司表示,安全測試顯示無法排除該系統達到「關鍵」網路安全能力的可能性——這是其準備框架下的最高等級。在此之前,沒有任何 OpenAI 模型如此接近這一門檻。Astra 現已轉入隔離測試環境,配備受限的網路存取、加密的模型權重和沙箱執行;政府機構和外部安全團隊將在任何發布前對其進行獨立測試。
競爭格局正在快速演變。微軟首款網路安全專用模型 MAI-Cyber-1-Flash 在搭配 GPT-5.4 時於 CyberGym 基準測試中取得 96% 的分數,領先 Anthropic 的 Mythos 12 個百分點。Anthropic 於 6 月發布了 Mythos 的限制版本,配有限制其網路安全和生物研究能力的護欄,將無限制版本保留給少數經認證的組織。
對投資人而言,問題在於以防禦為導向的 AI 是否會成為一條持久的營收管線。OpenAI 擴展 Daybreak 可讓安全供應商將其模型嵌入產品中,這是將網路能力商業化的直接途徑。微軟在 OpenAI 中約 27% 的持股價值約為 1,350 億美元,這使其在前沿實驗室如何將這些工具變現方面擁有直接利益。CrowdStrike、思科和 Palo Alto Networks 現在可以轉售 OpenAI 的網路模型,它們有望在擁擠的端點和漏洞市場中獲得差異化的產品。
本文僅供參考之用,不構成投資建議。