Anthropic 推出 Claude Fable 5.1 首度允許一般用戶發掘軟體漏洞
AI 奇點前沿

Anthropic 推出 Claude Fable 5.1 首度允許一般用戶發掘軟體漏洞

AI News Bot
2026-09-03
預計閱讀 1 分鐘原文來源

Anthropic 推出 Claude Fable 5.1 首度允許一般用戶發掘軟體漏洞

Anthropic 於 9 月 1 日正式發表新一代旗艦模型 Claude Fable 5.1,同時同步推出 Mythos 5.1。兩者基於相同的底層模型,但在安全防護等級上做出區隔:Mythos 只供特定機構使用,Fable 則面向所有一般使用者。此輪更新最大的亮點,是 Fable 5.1 首次放寬資安護欄,允許使用者利用 AI 協助 發掘原始碼中的軟體漏洞,但仍嚴格禁止開發攻擊程式、執行滲透測試或二進位漏洞掃描。

背景與技術提升

  • 上下文長度:兩款模型皆支援 100 萬 token(約 750 KB)上下文,單次輸出上限達 12.8 萬 token。
  • 效能提升:相較前代,Fable 5.1 在科學研究基準上提升 52.6%,業務流程自動化提升 31.4%。
  • 程式設計基準(Terminal‑Bench 4.0):Fable 5.1 取得 55.8% 分數,Mythos 5.1 則為 60.9%。Anthropic 解釋,Fable 在測試時仍受安全護欄介入,部分回應由 Opus 系列代答,因而分數較低;Mythos 則在解除護欄後測得真實能力。
  • 不可見浮水印:為符合歐盟 AI 法案,兩款模型內建不可見浮水印,以防止未授權的再利用。

在成本方面,Fable 5.1 的快取讀取費用下降 75%,使典型工作負載成本降低 25%,代理式任務更省 45%,並加入防蒸餾機制(防止模型被「蒸餾」成較低階版本)。企業客戶可透過新推出的 EFS(Zero‑Retention)方案,在今年秋季分階段取得零資料保留的隱私保護。

資安功能的差異

  • Fable 5.1:允許開發者與研究人員利用 AI 掃描程式碼,找出潛在弱點,據稱可將誤報率降低約 60%。然而,Anthropic 明確劃出紅線,禁止將模型用於編寫惡意程式、執行滲透測試或二進位漏洞掃描。
  • Mythos 5.1:在解除防護的測試中,於 ExploitBench、OSS‑Fuzz、Firefox 147、ExploitGym 等資安基準上均超越 Opus 5,成為 Anthropic 迄今發布的資安能力最強模型。該模型僅透過 Cyber Verification Program(CVP) 與 Life Sciences Verification Program(LSVP) 兩項信任存取計畫,分別提供給經審核的資安防禦者與生命科學研究者,且目前僅限美國機構申請。

未來展望

Fable 5.1 的開放使用標誌著大型語言模型在資安領域的「可控開放」新階段。若能在保持嚴格防護的前提下,讓更多開發者受惠於 AI 輔助的漏洞偵測,將有助於提升整體軟體供應鏈的安全韌性。未來 Anthropic 仍需持續監測模型被濫用的風險,並透過政策與技術雙管齊下,確保 AI 服務既能推動創新,也不成為攻擊者的工具。

讀者提示:若您關注資安新訊,建議訂閱資安日報與資安週報的免費電子報,掌握全球與臺灣最新資安脈動。

分享