預計閱讀 1 分鐘原文來源
主要亮點
OpenAI 於 9 月 22 日正式推出 GPT‑6 Sol 與輕量版 GPT‑6 Luna,兩者均採用與前代 GPT‑6 Astra 相近的訓練方法,針對 程式開發、電腦操作、事實校正 以及 指令遵循 進行加強。
- 成本:Sol 的每百萬 token 輸入/輸出費用從 4/20 美元降至 2/10 美元,Luna 則從 0.2/1.2 美元降至 0.1/0.5 美元,相當於前代的一半甚至千分之一。
- 效能:Sol 在多項基準測試中超越 Anthropic Opus 5,且每項任務成本僅為其 9%;同時也領先 Claude Fable 5.1。Luna 以 1/10 成本 超過前代 5.6 Sol。
- 事實正確性:Sol 的錯誤率較 GPT‑5.6 減半,Luna 的表現與 Sol 相近但價格僅 1/100。
背景與技術升級
OpenAI 透過 快取(caching) 與 推論優化,提升模型回應速度並減少 token 消耗。新加入的診斷工具、快取儀表板以及 prefix 設定,讓開發者能更精細地管理上下文重用。這些功能不僅降低了運算成本,也縮短了 AI 代理人在多輪對話中的回應時間。
在程式碼生成方面,OpenAI 引用內部研究指出,當前 AI 輔助開發的每日成本平均高達 600 美元,Sol 與 Luna 的成本下降將直接削減開發團隊的支出。測試包括 FrontierCode、DeepSWE v1.1 以及 OSWorld offline 2.0,Sol 的表現已逼近 Claude Fable 5/5.1 的水準。
市場與產業影響
- 企業:成本減半的 API 價格使中小企業更易導入高階語言模型,提升內部自動化與客服效率。
- 開發者:Luna 的 Free 與 Go 桌面版提供門檻更低的使用體驗,鼓勵個人開發者在本機環境測試新功能。
- 競爭格局:Sol 以更低成本挑戰 Anthropic 與 Claude 系列,預計加速產業向「高效能、低成本」的方向演進。
未來展望
OpenAI 表示,Sol 與 Luna 仍會持續受益於 Astra 的 模型對齊(alignment) 改進,未來將推出更多針對特定領域(如醫療、金融)的微調模型。對於關注 AI 安全 與 事實真確性 的使用者而言,這兩款模型提供了更可靠的文字生成基礎,亦為 AI 與人類協同工作樹立了新的品質標準。
讀者提示:若您正考慮將 AI 引入開發流程,建議先在 Free 版 Luna 上驗證概念,再根據實際需求升級至 Sol,以兼顧效能與成本的最佳平衡。
分享