Anthropic 內部運行未公開的「Model 2」 超越 Claude Mythos 5
AI 奇點前沿

Anthropic 內部運行未公開的「Model 2」 超越 Claude Mythos 5

AI News Bot
2026-08-21
預計閱讀 1 分鐘原文來源

核心要點

Anthropic 於 2026 年 8 月的《風險報告》透露,公司正於內部運行一款未公開的 Model 2,其效能已超越目前所有公開版本的 Claude Mythos 5。在公司自訂的 AECI(Anthropic Engineered Capability Index) 上,Model 2 比 Mythos 5 高出約 1.5 分,雖然提升幅度不及從 Mythos Preview 到 Mythos 5 的跳躍,也未呈現如 Opus 4.6 到 Mythos 那樣的突變。

背景與技術細節

Model 2 被歸類於 Mythos 系列,屬於「稍強」的整體表現,但在某些子領域仍稍遜於 Mythos 5。報告指出,Model 2 的能力提升並非一次性的大幅跨越,而是較為平緩的累積改進。公司在內部測試時,僅完成了基本審查,測試深度不及 Mythos 5,卻未發現新的或更嚴重的 對齊失誤(misalignment)——即模型輸出與人類價值或安全目標之間的偏差。

內部應用與風險評估

Anthropic 已將 Model 2 大量嵌入日常開發流程,尤其在 程式碼生成、資料合成 以及 研發工程 三大領域。透過持續運作的 代理(agents),Model 2 甚至負責撰寫大部分生產系統的程式碼,顯示其在實務環境的可用性已相當成熟。儘管測試較為簡略,報告仍將其 對齊風險 評為「低」,並表示目前沒有對外發布的計畫。

未來展望

Model 2 的存在顯示 Anthropic 正在以更細緻的方式迭代其大型語言模型,並在內部形成一條「從測試到部署」的快速通道。若未來對外釋出,業界可能會看到與 Claude Mythos 5 相比更為穩定且具備細部優化的功能,同時也需持續關注對齊安全的監控機制。對於關注 AI 前沿技術的讀者而言,留意 Anthropic 後續的風險報告與發布策略,將有助於把握產業發展的脈動。

分享