智譜 GLM-5.3 在漏洞開發上逼近 Claude Mythos,缺乏安全防護
網路安全

智譜 GLM-5.3 在漏洞開發上逼近 Claude Mythos,缺乏安全防護

AI News Bot
2026-10-01
預計閱讀 1 分鐘原文來源

事件概述

根據 Anthropic 前線紅隊(Frontier Red Team)的最新分析,智譜 AI(在境外以 Z.ai 名義營運)的開放權重模型 GLM-5.3 在「漏洞開發」能力上已逼近其自家 Claude Mythos Preview。Anthropic 表示,GLM-5.3 能在極少人工介入下自行產出完整的網路攻擊程式,且其內建的安全防護機制幾乎可以被簡單方法繞過。更重要的是,與 Claude Mythos 只提供給受限防禦者的 Project Glasswing 測試不同,GLM-5.3 已對外公開下載,任何人皆可取得。

技術測試與結果

  • ExploitBench(評估模型對 Chrome V8 引擎已知漏洞的利用能力)顯示,GLM-5.3 在 410 次嘗試中成功產生可執行漏洞利用程式 50 次,僅次於 Mythos Preview 的 56 次。
  • 在 Anthropic 內部的二進位利用基準(基於 Google OSS‑Fuzz 開源專案)測試中,GLM-5.3 能在 4% 的任務中完全控制目標程式,而 Mythos Preview 為 6%。較舊的 GLM‑5.2 與 Claude Opus 4.6 皆未通過此測試,Kimi K3、DeepSeek V4.1‑Flash 更是零成功。
  • 與人類安全專家合作時,GLM-5.3 在一天內發現多項 JavaScript 引擎的未知漏洞,並將其串接成可讀取訪客電腦任意檔案的惡意網頁,實測成功抽取私密 SSH 金鑰。Anthropic 已向瀏覽器開發團隊回報此漏洞。
  • 使用較小的 GLM-5.3‑Flash 版測試新發現的 Chrome 漏洞時,模型僅在 20 分鐘的人力指導與 8 小時的模型運算(約 20.40 美元 API 費用)內,完成繞過處理器額外防護的完整攻擊鏈。

安全風險與產業影響

美國國防資訊安全局(CAISI)的獨立評估亦指出,GLM-5.3 是迄今最具「網路攻擊」能力的開放權重模型,僅比美國最先進的內部模型慢約四個月。但 CAISI 測試時將美國模型的防護功能全部關閉,且最高等級模型僅限審核用戶使用,故比較仍有前提限制。

GLM-5.3 的開放性意味著惡意攻擊者可低成本、低門檻取得自動化漏洞開發工具,可能加速「零日」漏洞的商品化與散佈,對全球軟體供應鏈構成新一波威脅。

未來展望與建議

  1. 加強模型防護:智譜 AI 必須在模型發布前內建更嚴格的安全過濾與行為限制,避免簡易繞過。

  2. 業界共享情資:如同 Anthropic 的 Project Glasswing,建議成立類似的受控測試平台,讓防禦者先行取得模型,並共同研發防護對策。

  3. 政策與法規:政府機構可考慮將具備高危害潛力的開放模型納入風險評估範疇,制定相應的發布與使用規範。

  4. 持續監測與回報:安全研究人員應持續以 GLM-5.3 為測試目標,快速發現並上報新漏洞,減少惡意利用的窗口期。

在人工智慧快速演進的今天,模型的「攻擊」能力與「防護」能力同樣重要。唯有在開放創新與安全防護之間取得平衡,才能確保技術惠及社會而非成為新型網路武器。

分享