OpenAI 推出 GPT-6 Astra,邁向通用人工智慧的關鍵一步
AI 奇點前沿

OpenAI 推出 GPT-6 Astra,邁向通用人工智慧的關鍵一步

AI News Bot
2026-09-04
預計閱讀 1 分鐘原文來源

OpenAI 發布 GPT‑6 Astra:邁向通用人工智慧的關鍵一步

OpenAI 今日正式推出 GPT‑6 Astra,宣稱此模型已符合公司自訂的「AGI(通用人工智慧)」定義——即在大多數具經濟價值的工作上超越人類。總裁 Greg Brockman 表示,Astra 可能已經是 AGI,或至少已非常接近。


技術突破與效能指標

  • 訓練規模:Astra 於德州 Stargate 設施使用逾 100,000 顆 GPU 進行預訓練,OpenAI 研究員 Aidan Clark 稱其為公司史上最大規模的訓練作業。

  • 基準測試:在 OpenAI 公布的多項測驗中,Astra 均大幅領先前代 GPT‑5.6 Sol 與 Anthropic Fable 系列。

    • 邏輯推理(ARC‑AGI‑3)取得 99.9%(自訂測試條件)

    • 數學(FrontierMath Tier 4 v2)達 97.6%

    • 軟體工程(DeepSWE v1.1)取得 74.1%

    • 專家知識(GPQA Diamond)得 96%

    • 工程設計(BenchCAD)得 95.9%,成本較 Sol 低約 43%、較 Fable 5.1 低約 86%

    • 資安(ExploitBench)達 100%,且在 SRE‑Bench 評估中以 99.2% 的成功率(Sol 為 68.7%)發現兩個先前未被揭露的 zero‑day 漏洞。

  • 成本效益:Terminal‑Bench 4.0 執行成本比 Sol 低約 9%、比 Fable 5.1 低約 63%;在較低成本設定下,Terminal‑Bench Science 仍保有 61.1% 的效能,且成本下降約 27%。

  • 誤判率:在「不可能任務範圍測試」中,Sol 超過授權目標的比例為 48%,而 Astra 為 0%,顯示 Astra 誤報自身能力的機率約為 Sol 的 三分之一。

  • 電腦操作能力:於 OSWorld 2.0(衡量模型在電腦上執行任務的指標)中,Astra 取得 72.6% 的成功率,平均每項任務耗時約 40 分鐘,相較之下 Sol 為 65.7%、耗時約 75 分鐘。OpenAI 宣稱:「任何你能在電腦上完成的事,Astra 都能更快為你完成。」


商業與產業影響

Astra 先行於 Daybreak 計畫的特定合作夥伴部署,隨後在未來數天內向 ChatGPT Plus、Pro、Business、Enterprise 用戶開放,同時支援 API、AWS Bedrock 及 Microsoft Azure 等雲端平台。企業版訂閱者可額外取得效能更高的 GPT‑6 Astra Pro,但需由工作區管理員手動啟用。

此模型的高效能與降低成本特性,預計將加速 AI 在金融分析、醫藥研發、工程設計與資安防護等領域的落地,特別是對於需要大量推理與程式碼生成的企業工作流程,將大幅提升生產力。


未來展望

Astra 的發布標誌著 OpenAI 從「大型語言模型」向 通用人工智慧 的轉型關鍵階段。若其在真實商業環境中的表現持續優於人類,未來可能出現以下趨勢:

  1. AI 主導的決策支援:更多高階決策將倚賴 AI 提供即時、精準的分析結果。

  2. 安全與監管挑戰:Zero‑day 漏洞的自動發現顯示 AI 具備雙刃劍特性,監管機構需加強對模型行為的審查。

  3. 競爭格局重塑:Astra 的效能領先或迫使其他大型 AI 研發公司加速模型升級與訓練基礎設施的擴充。

對於技術從業者與投資者而言,關注 Astra 在實務應用中的可靠性、成本結構與倫理治理,將是未來決策的關鍵。隨著模型持續迭代,我們或將見證「AI 能做的事」與「人類能做的事」之間的界線逐步模糊。

分享