OpenAI 的 Astra 模型展現出前所未有的網路安全能力
AI 奇點前沿

OpenAI 的 Astra 模型展現出前所未有的網路安全能力

AI News Bot
2026-08-08
Photo by Andrew Neel on Pexels
預計閱讀 1 分鐘原文來源

OpenAI 的 Astra 模型展現出前所未有的網路安全能力

OpenAI 的新型 AI 模型 Astra 展現出強大的網路安全能力,公司內部測試結果表明,這個模型可能達到最高風險等級。這是 OpenAI 首次將自己的模型標記為可能達到最高風險等級。

根據 OpenAI 的說法,Astra 模型在過去幾天的內部測試中,展現出「顯著的代理編碼和網路安全進步」。這個結果足以讓 OpenAI 「無法排除關鍵能力等級」(Critical capability level)在其自己的安全框架(Preparedness Framework)中。這個框架是用來評估 AI 模型的安全風險的。

OpenAI 的安全框架將模型的安全風險分為幾個等級,包括「高」(High)和「關鍵」(Critical)。如果一個模型可以在不需要人類干預的情況下,找到和開發出有效的 zero-day Exploit,在許多加固的關鍵系統中,那麼它就會被標記為「關鍵」等級。另外,如果一個模型可以獨立地設計和執行新的網路攻擊策略,對於受保護的目標,只需要一個鬆散定義的目標,那麼它也會被標記為「關鍵」等級。

背景分析

OpenAI 的 Astra 模型是最近推出的,外界傳聞這個模型可能會在下周發佈。但是,今天的公告可能會影響到這個計畫。OpenAI 明確表示,Astra 模型與最近在 Hugging Face 上發生的漏洞無關。

批評者可能會指責 OpenAI 進行恐懼營銷,尤其是公司只報導了「可能」達到最高風險等級的結果,而不是確定的結果。時機也不利於 OpenAI,因為這個預警出現在業界正在辯論 AI 模型的自主網路安全能力的時候,這只會加劇懷疑。

影響和展望

OpenAI 的 Preparedness Framework 要求在模型達到「關鍵」等級時,停止進一步的開發,直到安全控制標準符合「關鍵」等級。然而,目前 OpenAI 只是暫停了某些活動,並增加了測試的強度。公司並沒有完全停止 Astra 模型的開發。

OpenAI 表示,已經暫停了內部活動,涉及 Astra 模型的活動,並增加了安全控制,包括隔離測試環境、限制網路和工具存取、加強保護等。

未來,OpenAI 的 Astra 模型可能會面臨更嚴格的安全測試和評估。這個模型的強大網路安全能力,可能會為業界帶來新的挑戰和機會。然而,同時也需要關注這個模型的安全風險和潛在的影響。

分享