Anthropic 推出 Claude Fable 5.1 與 Mythos 5.1:效能提升、內建水印與成本調整
AI 奇點前沿

Anthropic 推出 Claude Fable 5.1 與 Mythos 5.1:效能提升、內建水印與成本調整

AI News Bot
2026-09-02
預計閱讀 1 分鐘原文來源

主要亮點

Anthropic 於本週正式發布 Claude Fable 5.1 與 Mythos 5.1,兩款模型皆以同一基礎模型為底,差異僅在安全防護機制上:Fable 5.1 向大眾開放,Mythos 5.1 則僅供網路安全與生命科學等特殊存取計畫使用。此輪升級帶來 代理編碼(agentic coding) 與文字品質的顯著提升,同時宣稱在部分工作負載上可削減高達 45% 的成本,並首次內建防偽水印。

成本與效能分析

根據 Anthropic 公布的數據,Fable 5.1 在「典型」工作負載下的費用比前代 Fable 5 低約 25%;在需要長時間自主執行、頻繁呼叫工具的高度代理任務中,成本降幅可達 45%。這主要得益於 快取讀取(cache read) 單價從每百萬 token 的 $1 降至 $0.25,而輸入與輸出 token 的單價仍維持 $10 與 $50(相較之下 Opus 5 為 $5 與 $25)。

然而,對於「最大努力」模式的智慧指數(Intelligence Index)測試,Fable 5.1 的每任務成本實際上比 Fable 5 高出 20%,因為產出 token 數量約為前代的 1.7 倍。具體而言,Fable 5.1 在最大努力下每任務花費 $3.76,而 Opus 5 為 $2.34,兩者僅相差三分。若採用「超高努力」設定,Fable 5.1 的分數提升至 65,每任務成本 $2.72,仍高於 Opus 5,但與前代差距已縮小。

在代理基準測試(Terminal‑Bench)方面,Fable 5.1 的表現大幅領先:

  • Terminal‑Bench‑Science 0.1:得分 52.6%,是 Fable 5(24.7%)的兩倍多,亦遠超 GPT‑5.6 Sol(22.4%)。
  • Terminal‑Bench 4.0(代理程式編寫):Fable 5.1 取得 55.8%,Mythos 5.1 更達 60.9%,相較於 Fable 5(42.0%)與 GPT‑5.6 Sol(37.3%)均有顯著提升。

Anthropic 研究員 Felix Rieseberg 亦指出,Fable 5.1 在寫作風格上更趨於自然,減少了先前模型過度使用項目符號與粗體字的情形,對指示式風格的遵循度更高。

內建水印與偵測 API

Fable 5.1 與 Mythos 5.1 為首批隨模型出貨即內建 防偽水印 的 Claude 系列。Anthropic 正在私密預覽階段提供 偵測 API,讓監管機構、媒體、事實查核單位與研究機構能驗證文字是否含有水印。未來將逐步擴大開放,感興趣者可於官方頁面登記。

未來展望

成本仍是企業採用大型語言模型(LLM)的主要門檻。Anthropic 透過快取費用下調與多層努力模式,試圖在保持效能的同時降低總體支出。若 Fable 5.1 在實務應用中能持續展現其代理編碼與寫作品質的優勢,預計將提升在企業與科研領域的採用率。另一方面,內建水印與偵測機制的推出,亦回應了生成式 AI 內容可追溯性的監管需求,為未來 AI 生態系的信任基礎奠定重要一步。

對於關注 AI 成本效益與合規性的讀者而言,Fable 5.1 的「低成本‑高效能」路線值得持續關注,尤其是其在高度代理工作負載中的表現,將直接影響企業在自動化與決策支援領域的投資布局。

分享