
Photo by Tima Miroshnichenko on Pexels
預計閱讀 1 分鐘原文來源
Z.ai 釋出 GLM‑5.3‑Flash:從匿名測試到程式設計 AI 之王
中國 AI 業者 Z.ai 於 8 月 26 日正式上線 GLM‑5.3‑Flash,同時揭露這款模型在 OpenRouter 與 OpenCode 先前以「Ox Alpha」匿名名稱提供的測試版本。測試期間,Ox Alpha 佔 OpenRouter 程式設計模型同步使用量 30.9%,處理詞元(token)高達 10.3 兆,一度成為平台使用量第一名。
背景與技術亮點
- 多模態原生模型:GLM‑5.3‑Flash 為 GLM‑5 系列首支支援文字與影像等多種資料型態的模型,參數總量 3,200 億,每個詞元約動用 180 億 參數。
- 硬體優化:測試期間使用數萬顆中國自行研發的 AI 加速器,針對長篇與多模態推論進行調校。Z.ai 表示,同等硬體上經最佳化後,端到端效能提升約 3 倍,每個詞元的處理成本可與主流 Nvidia GPU 相近。
- 公開權重:模型權重已於 Hugging Face 公開,方便研究社群下載與再利用。
資料治理的爭議
在 OpenRouter 上,Ox Alpha 被標示為「匿名模型」,使用者只能看到 「匿名供應商」 的字樣,無法得知實際開發者或運算叢集所在地。平台的 匿名模型計畫使用條款 明確規定,使用者的提示詞與回覆可供供應商用於 模型訓練、評估與改進,但模型頁面卻寫明「不會用於訓練」。此說明不一致揭露了資料用途、處理方與處理地點的透明度缺失。
Z.ai 的隱私政策與 API 附約指出,其服務多在 新加坡 由子公司或指定服務商處理個人資料。但這些文件僅適用於 Z.ai 自有服務,無法證實 Ox Alpha 測試時的實際運算叢集是否亦位於新加坡,亦未說明是否有跨境傳輸。
未來展望與讀者啟示
GLM‑5.3‑Flash 正式上線後,已不再以匿名身份出現在平台,Z.ai 也公開了模型權重與硬體配置,為 AI 產業的 透明化 樹立新標桿。對開發者而言,選擇模型時應關注以下三點:
-
資料治理:確認模型供應商的資料保存與使用政策是否與平台聲明一致。
-
運算所在地:了解推論叢集的實際地理位置,評估跨境資料傳輸的合規風險。
-
多模態支援:若需求涉及文字與影像,選擇原生多模態模型可減少額外前處理成本。
隨著中國 AI 企業在全球模型市場的佔比持續上升,如何在 效能、成本與資料治理 之間取得平衡,將成為業界與監管機構共同面對的關鍵課題。
分享