預計閱讀 1 分鐘原文來源
台灣主權AI評測結果揭曉 本土模型在價值觀表現領先
AI 產品與系統評測中心(AIEC)於 9 月 2 日公布最新「台灣主權AI」測試結果,首次以三項指標全面評估 188 個國內外通用大型語言模型(LLM)。測試顯示,三款本土模型在台灣價值觀的準確率高達 92%‧100%,明顯優於所有外國模型。
何謂「主權AI」?
數位發展部部長林宜敬在記者會上說明,主權 AI 必須同時具備兩大核心要件:
-
在地語言與文化理解——模型需能流暢處理繁體中文,並熟悉台灣的歷史、制度與社會脈絡。
-
本土算力部署——運算中心必須設於台灣境內,受台灣法律管轄,確保資料治理與模型運作符合本國法規。
三項評測指標的設計
-
語言能力:採用近五年高中學測國文科題目,測試模型對繁體中文詞彙與語意的掌握。
-
社會文化理解:以高中學測社會科題目檢驗模型對台灣歷史、地理、公民與制度的認知。
-
價值觀判斷:題目圍繞「台灣藍、綠、白具有共識,與中國無共識」等議題,評估模型是否能給出符合台灣社會共識的回應。
測試結果概覽
- 繁體中文理解:外國模型的正確率介於 76%‧99% 之間,本土模型則落在 78%‧86%。
- 社會文化理解:外國模型正確率 80%‧89%,本土模型 71%‧84%。
- 價值觀表現:外國模型 72%‧90%,本土模型則高達 92%‧100%,成為唯一在此指標上全面領先的群體。
垂直領域的主權AI布局
除通用模型外,政府正同步推動四大垂直領域的在地化語言模型:
- 金融:金管會牽頭,19 家金融機構聯手,由亞太智能(AMPIC)負責訓練,確保回應符合台灣金融法規與專業用語。
- 法務:法務部合作,同樣委由亞太智能建置,納入本土法律、司法程序與檢調作業流程。
- 教育:教育部以「因材網」教材為基礎微調模型,目標提供中小學課程知識、個別化學習建議與教師教學設計。
- 醫療:由中國醫藥大學附設醫院與長聯科技共同開發護理大語言模型,涵蓋基礎醫學、護理、內外科等專業領域。
未來展望
林部長指出,AIEC 將持續擴大評測生態系,串聯資料治理、資安、硬體等產業力量,透過第三方測試打造「可信任 AI」。同時,政府希望協助本土軟體業者將主權 AI 商品化,向海外輸出符合在地需求的解決方案,為其他國家提供建立自主管理 AI 的參考範本。
結語:本次評測不僅驗證了本土模型在價值觀層面的優勢,也凸顯台灣在 AI 主權化路徑上的決心與實務進展。未來,隨著垂直領域模型陸續成熟,台灣有望在全球 AI 生態中占據更具影響力的在地化位置。
分享
