GPT-6 Astra Scores 100% on ExploitBench as OpenAI Blocks PoC Exploit Requests
概述
OpenAI 於本週四正式發表 GPT‑6 Astra,自稱是「全球最智慧且最對齊(aligned)的模型」。此模型在 OpenAI 內部的 Preparedness Framework(備援框架)中,已突破「Critical」等級的資安能力門檻,標誌著 AI 在資安領域的成熟度達到新高。
技術表現與測試結果
- FrontierMath Tier 4:取得 98% 的滿分,顯示其在高階數學推理上的卓越表現。
- ARC‑AGI‑3:得分 99.9%,證明模型在通用人工智慧測驗中的接近完美。
- ExploitBench:此測試衡量模型將已知軟體漏洞轉化為可運作的利用程式(exploit)的能力,Astra 獲得 100% 的滿分,遠超前代 GPT‑5.6 Sol 的 78.5%。
在 2026 年 6 至 8 月間披露的漏洞中,Astra 的任意程式碼執行(arbitrary code‑execution)成功率顯著高於前代,甚至包含兩件 Zero‑day(零日漏洞,指尚未公開或修補的漏洞)案例。若不受任何安全防護,Astra 亦能利用未知漏洞在硬化(hardened)瀏覽器中執行程式碼,或在硬化作業系統上開發提權(privilege‑escalation)利用程式。
安全與濾鏡策略
考量此類 雙重用途(dual‑use) 技術——既能協助防禦方快速發現弱點,也可能被惡意攻擊者濫用——OpenAI 將公開的 Astra 版本限定於 安全程式碼審查與修補,並 拒絕 任何關於產生概念驗證(PoC)利用程式的請求。
OpenAI 於 Daybreak 計畫中表示,未來數週將擴大存取,同時放寬部分防護,以支援漏洞與 PoC 驗證、惡意程式分析、偵測工程等防禦性工作流程。
為防止模型被「越獄(jailbreak)」,OpenAI 加強了模型的魯棒性、擴充了監控上下文,並加入額外的安全檢查。這些檢查在敏感環境下可能會中斷合法的防禦任務,屆時系統會提示使用者審核後再繼續。
未來展望
Astra 目前正向少數企業客戶滾動部署,未來將陸續提供給 ChatGPT Plus、Pro、Business、Enterprise 用戶,並透過 OpenAI API、Microsoft Azure、Amazon Web Services(AWS)Bedrock 供應。隨著防護機制的逐步放寬,業界可望在不犧牲安全的前提下,利用 Astra 加速漏洞修補與威脅偵測。然而,如何在提升防禦效率與防止濫用之間取得平衡,仍是未來政策與技術研發的關鍵課題。
結語:GPT‑6 Astra 的全方位高分表現顯示 AI 已可在資安領域扮演「雙刃劍」角色,企業與研究機構需要在採用前審慎評估其安全設定,才能真正把握這項突破性的技術所帶來的防禦優勢。