數發部公布臺灣主權AI評測 攜手產官打造可信任AI
記者郭曉蓓/臺北報導
數位發展部今(2)日公布首波臺灣主權AI評測結果,在包含OpenAI、Anthropic、Google等國際大廠一同接受檢視下,雅婷智慧、亞太智能機器、鴻海研究院與長聯科技等4家國產模型業者表現亮眼,雅婷智慧、亞太智能機器更擠進前10強,甚至在「臺灣價值觀」項目獲得滿分,證明臺灣具備自行訓練模型的能力,並能訓練出良好的模型。
數發部長林宜敬表示,主權AI有兩個重要意義,第一,AI模型必須有臺灣觀點,包括熟悉臺灣語言、社會環境及具備臺灣價值觀;第二,臺灣必須建立算力中心,讓AI模型在臺灣運行,以受到臺灣法律管轄。
數發部今日舉辦「主權AI評測×可信任AI行動」記者會,由AI產品與系統評測中心(AIEC)公布臺灣主權AI評測結果。在包含國際大廠在內的188個參測模型中,雅婷智慧的Yating-FedGPT-1.10.18總分排名第4,亞太智能機器ACE-1-24B-2604排名第10,鴻海研究院FoxBrain v2.0排名第12,臺灣智慧雲端Llama3.3- FFM-70B排名第48。
此次評測由AIEC執行,從臺灣語言、社會文化及價值觀3大面向檢驗AI模型。其中雅婷智慧、亞太智能機器、鴻海研究院及長聯科技等國產模型表現亮眼,雅婷智慧、亞太智能機器的模型在「臺灣價值觀」項目更是獲得滿分。
數發部表示,目前大型語言模型普遍面臨繁體中文理解不足、臺灣在地知識有限及缺乏臺灣觀點,就算能以繁體中文回答,也可能套用其他國家的政治敘事、法律制度或社會脈絡。數發部以近5年高中學測國文科與社會科題目,透過科學的方法,檢驗模型的臺灣語言能力及社會文化理解能力,並透過臺灣社會具一定共識,評估模型對「臺灣價值觀」的理解。
數發部指出,臺灣業者更進一步發展法務、金融、教育、醫療等垂直領域的主權AI模型,納入我國特有的制度、法規、專業知識與實務情境,對於臺灣的價值觀也有相當好的表現。數發部推動臺灣主權AI的目的之一,是希望臺灣本土軟體公司能在這個基礎上,將開發出來的軟體產品化、模組化,並輸出到海外,協助其他國家建立具在地特色的主權AI模型。
數發部產業署表示,將持續擴大國內AI評測夥伴生態系,並串聯硬體、資安、資料治理、模型訓練等產業能量,透過評測建立信任、以信任帶動產品發展,並將臺灣累積的AI評測及解決方案經驗推向國際,讓臺灣AI實力被世界看見。