同一週,OpenAI 一邊說下一代 Astra 可能觸及 Critical 網路能力而踩煞,一邊把「夠強、但還沒 Critical」的資安專模交到審核過的防禦者手上。公司擴充 Daybreak 計畫為雙軌:Blue 給已核可防禦者使用含 GPT-5.6 Sol 的前沿通用模型(系統級資安護欄為授權防禦工作調整/放寬);Red 則解鎖專訓的 GPT-5.6-Cyber,用於授權漏洞研究、exploit 驗證與安全測試。Axios、CSO Online、Unite.AI、The New Stack、CyberPress、硬是要學等跟進;官方部落格題為「防禦窗口正在變窄」。
這則和站內 Astra Critical 暫停要並讀,不要混成一件事:Astra 是尚未公開、可能過 Critical 的旗艦風險;Cyber 是已評 High、刻意閘控釋出的防禦工具。
95% 完成率量的是「肯答」,不是「答對」
OpenAI 用內部指標 Advanced Cybersecurity Completion Rate 衡量模型對 exploit 鏈、認證繞過、權限提升等請求是回應還是拒答。數字落差極大:
| 設定 | 完成率(公司自測) |
|---|---|
| GPT-5.6 Sol 標準護欄 | 約 1.5% |
| GPT-5.6 Sol+Daybreak Blue | 約 2.0% |
| 前代 GPT-5.5-Cyber | 約 57.3% |
| GPT-5.6-Cyber(Red) | 約 95.0% |
新聞標題愛寫「95%」——讀者要記住:這是拒答率/完成意願,不是漏洞發現準確率。能力評測更分裂:ExploitGym 上 Cyber 勝過 Sol 與 5.5-Cyber;漏洞報告寫作品質上,Cyber 可能短於 Sol;更難的 ExploitBench(含 V8 sandbox)在標準回合上限內,通用 Sol 有時更好,延長回合後差距縮小。全是廠商自測,外部尚未完整複現。
真實世界錨點比較硬:團隊用 Cyber 查 Chrome 的 V8,挖出兩個可串聯的未知弱點,可能造成記憶體破壞並逃離 V8 heap sandbox;經協調揭露後,Google 修補並登錄 CVE-2026-15903。另列(未具名)行動 OS 至少五個漏洞、主流資料庫三個關鍵遠程代碼執行路徑、以及某熱門 OS 核心逾 400 個權限提升類問題——多在與 Daybreak 夥伴/開源維護者協調披露中。SpecterOps 早期測試描述成「過去幾週斷續做不完的事,一天內壓完」——這是工作壓縮敘事,不是自動化取代紅隊的保證。
Chrome 發布說明與 NVD 軌跡讓 V8 案例可被外部核對;其餘未具名漏洞則仍停留在「公司宣稱+協調中」層級。讀新聞時應把兩者分開:一個是已修補的公開 CVE,一組是數量驚人但細節未公開的管線數字。
為什麼要拆 Blue/Red
通用模型的系統護欄擋惡意網路請求,也擋合法防禦工作。Blue 給核可用戶拿掉/放寬那層;即便如此,對生產環境滲透測試等高度雙重用途提示,Sol 仍可能拒——於是 Red 用專訓模型專門降低這類拒答、加強零日與 exploit 鏈能力。Preparedness Framework 下,Sol 與 Cyber 的網路能力皆評 High、低於 Critical;公司並重申 Cyber 未參與 Hugging Face 入侵相關事件,該類涉事模型也不在釋出路徑。
治理配套同樣是新聞本體:身分核驗、監控、核准用途、法律聲明;個人與組織申請路徑分開;推 Codex 從 full-access 轉向 auto-review(高權限動作先審);個人 Daybreak 帳號自 2026-09-01 起強制硬體安全金鑰。System Card 承諾稍後補。商業面,Accenture、IBM、CrowdStrike、Cisco、Palo Alto Networks 等可把能力嵌進資安產品/託管服務;Cloudflare 亦表達與網路堆疊結合的意向。
和「防禦窗口變窄」敘事怎麼對上
OpenAI 的論點是:攻擊者很快也會用前沿模型縮短武器化時間,因此要把同等級能力先交防禦方。代價是閘控失敗時的外溢風險——模型本身被設計成「對紅隊問題說 yes」。企業採購若只看到「通過 Daybreak」徽章,應追問:出站是否隔離、是否禁止連生產網、auto-review 是否強制、硬體金鑰與身分綁定是否到位。這與同週評測誤配網、沙盒出站洩漏的教訓同構:能力再強,環境政策錯了照樣出事。
Daybreak 前史也有線索:六月曾推 GPT-5.5-Cyber 與夥伴計畫(Accenture、CrowdStrike、Cisco、IBM、Palo Alto 等),並與 Trail of Bits 等推動開源修補衝刺。Blue/Red 是把「單一受信通道」拆成兩級梯子——多數防禦者走放寬護欄的通用前沿,少數授權紅隊走拒答更低的專模。對資安產品商,這變成可以嵌入 SOC/託管服務的能力層;對監管與保險,則變成「誰核可、誰監控、出事誰負責」的合約題。
對一般開發者:這不是 ChatGPT 開關能開的模型。對資安團隊:申請門檻與合規義務會變成採購條款的一部分;CVE 軌跡證明「找洞→揭露→修補」鏈路可走通,但 95% 完成率不能寫進 KPI 當發現率。對監管觀察者:High 可閘控釋出、Critical 先暫停——Preparedness 分級正在變成產品節奏本身。
下一步看 System Card、硬體金鑰上路後的帳號流失、夥伴產品是否真把 Cyber 嵌進 SOC 工作流,以及外部基準能否複製 ExploitGym 優勢。OpenAI 給防禦者一把更肯動手的刀——刀鞘,寫在 Daybreak 的審核表裡。
