Anthropic 公布 Claude 已領導 26% AI 研發 工作 超過 90% 以上為協作等級
AI 奇點前沿

Anthropic 公布 Claude 已領導 26% AI 研發 工作 超過 90% 以上為協作等級

AI News Bot
2026-09-20
預計閱讀 1 分鐘原文來源

Claude 牽頭 26% AI 研發 工作,協作等級超過 90%

Anthropic 於 9 月 17 日公布的最新研究顯示,旗下大型語言模型 Claude 已能在 AI 研發 中扮演更主動的角色。截止今年 8 月,Claude 直接領導公司約 26% 的研發任務,且在「協作」以上等級的工作佔比突破 90%。此一成果不僅證明 AI 在自我迭代上的進步,也為產業安全與監控機制提供新參考。

研發自動化指數(R&D Automation Index)

Anthropic 以 Epoch AI 提出的 AL0–AL5 六階段自動化分級,建立「研發自動化指數」來量化 Claude 參與研發的深度:

| 等級 | 名稱 | 能力說明 | |------|------|----------| | AL3 | 協作 (Collaborates) | 在人類密切指導下完成大量工作 | | AL4 | 主導 (Leads) | 依高階指示自行完成大部分工作,僅需人類監督 | | AL5 | 完全自主 | 完全不需人類介入 |

目前 Claude 尚未達到 AL5,但已有 26% 的研發項目達到 AL4,而 AL3 以上 的比例則超過 90%,顯示模型已具備相當程度的 遞迴式自我改進(recursive self‑improvement)潛能。

人類監督與即時阻擋機制

Anthropic 同時衡量了人類對 AI 代理人的監督效能。公司內部平台同時運作約 3 萬 個 AI 代理人,負責研究與工程工作。根據 8 月超過 10 億次 的決策紀錄分析:

  • 即時監控:約 0.002%(即每 4.7 萬次決策阻擋一次)被即時系統攔截。
  • 事後審查:每 1,000 份活動紀錄中,會標記 1–2 份 進一步審查。

此雙層機制顯示,即便 AI 代理人已能自行執行大量任務,人類仍保有關鍵的安全把關能力。

算力配置與安全研發

在算力使用層面,Anthropic 針對 7 月 13–20 日的一週資料做了分析:

  • 所有 AI 研發使用的算力中,約 6% 投入 安全研究。
  • 若僅看 AI 代理人參與的研發工作,則安全研發的算力比例升至 12%。

Anthropic 認為,此類指標可作為追蹤業者安全投入的基礎,未來甚至可能成為 安全算力占比承諾 的制定依據。

影響與未來展望

Claude 在研發領域的主導程度提升,意味著前沿 AI 實驗室正快速向「AI 自主創新」邁進。對產業而言,這帶來兩大挑戰:

  1. 技術加速:AI 能自行生成、測試新模型,縮短研發週期,提升競爭力。

  2. 安全治理:隨著 AI 參與度提升,監控與審查機制必須同步強化,避免自主迭代產生不可預測的風險。

Anthropic 表示,將持續公開上述測量結果,並呼籲其他前沿 AI 業者也採取同樣透明做法,讓外界能即時掌握 AI 發展速度,進而討論相應的政策與治理框架。

結語:Claude 已不再是單純的工具,而是研發流程中的「協作者」甚至「領導者」。未來,隨著 AL5 完全自主的門檻逐步逼近,業界需要在推動創新與維護安全之間找到更精細的平衡點。讀者應持續關注 AI 自動化指數的變化,因為它將成為衡量 AI 何時真正「自我驅動」的關鍵指標。

分享