# OpenAI 推出 GPT-5.6-Cyber，進階資安請求完成率達 95.0%

> 📖 本站完整內容索引（documentation index）：[llms.txt](/llms.txt)

> 原作者：Tibo (@thsottiaux) · 策展與摘要：EasyVibeCoding · 平台：X (Twitter) · 熱度：🔥🔥🔥 · 日期：2026-08-12

> 原始來源：https://x.com/thsottiaux/status/2086874565909815403

## 證據與延伸閱讀

- [OpenAI 推出 GPT-5.6-Cyber，進階資安請求完成率達 95.0%](https://openai.com/index/expanding-daybreak-as-the-cyber-defense-window-narrows) — 官方文件
- [Tibo指出威脅變化推出新存取層級](https://x.com/thsottiaux/status/2086874565909815403)

## 中文摘要

OpenAI 推出 GPT-5.6-Cyber，進階資安請求完成率達 95.0%。

**核心發布**　Tibo 指出，資安威脅正在快速變化，OpenAI 因此推出新的 Daybreak Blue 與 Daybreak Red 存取層級，並提供 GPT-5.6-Cyber。對不確定如何開始的團隊，他建議聯絡合作夥伴，利用最新的資安模型尋找問題、快速修補、進行 pentesting 等工作。這些能力限定於經授權的資安用途，目標是在攻擊者大規模部署攻擊型 AI 前，先把前沿智慧交給可信任的防禦者。

<video src="https://pub-75d4fe1e4e80421b9ecb1245a7ae0d1a.r2.dev/curated/1786469870496-dy7eh0rr.mp4" poster="https://pub-75d4fe1e4e80421b9ecb1245a7ae0d1a.r2.dev/curated/f0e8efb9f21fa8dc.jpg" controls playsinline preload="metadata" style="max-width:100%;height:auto;display:block;margin:1rem 0"></video>
> 來源：[@OpenAI](https://x.com/OpenAI/status/2086864365379010729)（回覆）｜影片開場標題畫面顯示 OpenAI Daybreak 與資安防禦視窗縮小的主題文字

**兩種存取層級**　Daybreak Blue 是多數防禦團隊的建議起點，提供包含 GPT-5.6 Sol 在內的前沿模型，並針對廣泛的防禦工作調整防護機制，支援：

- 漏洞發現與管理
- 安全程式碼審查
- 惡意軟體分析
- 事件偵測與回應
- 修補程式驗證
- 資安評估

Daybreak Red 則面向具備經驗的防禦者，提供專門訓練的資安模型，包括 GPT-5.6-Cyber，用於經授權的漏洞研究、漏洞利用驗證與安全測試，特別是較複雜的資安挑戰。

![](https://pub-75d4fe1e4e80421b9ecb1245a7ae0d1a.r2.dev/curated/5cb448a45ec5458d.jpg)
> 來源：[@gdb](https://x.com/gdb/status/2086866967479341305)（回覆）｜Codex Security 的防禦與紅隊演練模型介紹頁面，頂部標題為 Models for defense and red teaming，下方並排展示 Daybreak Blue 與 Daybreak Red 兩款針對防禦與紅隊測試設計的 AI 模型，並各自附帶文字說明。

**GPT-5.6-Cyber 定位**　引用來源說明，GPT-5.6-Cyber 建立在 GPT-5.6 Sol 上，針對尋找 zero-day 漏洞、建立 exploit chain 等專門任務訓練，並降低部分高風險、具雙重用途資安工作的拒答率。OpenAI 的內部 Advanced Cybersecurity Completion Rate 評測顯示，GPT-5.6-Cyber 能完成 95.0% 的進階資安請求；GPT-5.6 Sol 為 1.5%，透過 Daybreak Blue 使用時為 2.0%，GPT-5.5-Cyber 則為 57.3%。

![](https://pub-75d4fe1e4e80421b9ecb1245a7ae0d1a.r2.dev/curated/bd78c60def92f242.jpg)
> 來源：[@OpenAI](https://x.com/OpenAI/status/2086864369825329219)（回覆）｜GPT-5.6-Cyber (Daybreak Red) 在高級網路安全任務完成率以約 95% 顯著領先其餘模型配置

**實際研究成果**　OpenAI 表示，GPT-5.6-Cyber 已用於真實漏洞研究，包括 Chrome 使用的 V8 JavaScript 引擎。研究人員發現兩個先前未知、可串聯造成記憶體破壞並逃逸 V8 heap sandbox 的漏洞，經驗證後透過協調式漏洞揭露通知 Google，最後其中一項被修補並編為 CVE-2026-15903。OpenAI 也提到，模型曾協助發現熱門行動作業系統至少五個漏洞、熱門資料庫三個重大漏洞，以及熱門作業系統核心超過 400 個可能導致權限提升的漏洞。GPT-5.6-Cyber 的早期合作夥伴包括 SpecterOps、SentinelOne 與 Palo Alto Networks。

![](https://pub-75d4fe1e4e80421b9ecb1245a7ae0d1a.r2.dev/curated/1c592f2eea90f53b.jpg)
> 來源：[@OpenAI](https://x.com/OpenAI/status/2086864372500942906)（回覆）｜CVE-2026-15903 Discovered by GPT-5.6 Cyber 漏洞分析架構圖，以三個主要區塊展示 JIT Compiler Bug、V8 Heap Sandbox 以及 JSPI Stack Escape 的技術細節與利用流程，版面包含多個流程圖解與狀態標示。

**能力仍有差異**　評測結果並非全面勝出。GPT-5.6-Cyber 在 ExploitGym 優於 GPT-5.6 Sol 與 GPT-5.5-Cyber，也在 zero-day 發現與技術報告評測中，以 Daybreak Red 的表現優於 GPT-5.6 Sol；但在 Vulnerability Discovery and Report Writing 評測中，GPT-5.6-Cyber 反而不如 GPT-5.6 Sol，OpenAI 認為原因可能是它有時產生較短、細節較少的漏洞報告。在 ExploitBench 的標準 300 turns 設定中，GPT-5.6 Sol 以較高的 token 效率表現最佳；增加到 600 turns 後，兩者差距縮小。OpenAI 另表示，兩個模型的資安能力都達到 Preparedness Framework 的 High 門檻，但尚未達到 Critical。

**存取限制與安全措施**　Daybreak Blue 與 Daybreak Red 僅開放給執行經授權工作的個人與組織，並要求身分驗證、帳戶安全、行為監控、核准用途限制與法律聲明。OpenAI 也將從 2026 年 9 月 1 日起，要求 Daybreak 個人帳戶採用硬體安全金鑰，並鼓勵使用 Codex 的客戶從 full-access mode 改用 auto-review mode，由系統在需要提高權限前檢查工具呼叫，必要時阻擋具破壞風險的請求。官方建議將工作放在隔離的沙盒中、避免接觸敏感的正式環境或開放網路，並為 Agent 行動配置監控、人員覆核與明確的權限範圍。更多資訊可參考 [OpenAI 的資安方案說明](https://openai.com/business/solutions/cybersecurity/) 與 [Daybreak 擴大計畫](https://openai.com/index/expanding-daybreak-as-the-cyber-defense-window-narrows)。

## 媒體內容

**GPT-5.6-Cyber (Daybreak Red) 在高級網路安全任務完成率以約 95% 顯著領先其餘模型配置**

**數據表**

| 項目 | 數值 |
| --- | --- |
| GPT-5.6 Sol (safeguards enabled) | 1.5% |
| GPT-5.6 Sol (Daybreak Blue) | 2% |
| GPT-5.5-Cyber (Daybreak Red) | 57.3% |
| GPT-5.6-Cyber (Daybreak Red) | 95% |

## 標籤

新產品, GPT, 資安, OpenAI
