哪款AI最懂台灣?這兩款「台灣價值觀滿分」 評測結果一次看

記者許若茵/台北報導

AI會說繁體中文,不代表真正懂臺灣!數位發展部透過AI產品與系統評測中心(AIEC)公布臺灣主權AI評測結果,檢驗模型是否具備臺灣語言、社會文化與價值觀等3大理解能力,並跨部會協作推動符合臺灣情境的金融、法務、教育、醫療等垂直領域大語言模型,其中兩款台灣價值觀獲得滿分。

數位發展部透過AI產品與系統評測中心(AIEC)公布臺灣主權AI評測結果。(圖/數產署提供)
數位發展部透過AI產品與系統評測中心(AIEC)公布臺灣主權AI評測結果。(圖/數產署提供)

數位發展部部長林宜敬表示,「主權AI」(Sovereign AI),有兩個重要的意義,首先,AI大語言模型的伺服器放在哪個國家,就必須遵守那個國家的法律;再者,由哪個國家訓練出來的大型語言模型,通常就會有那個國家的觀點與意識形態。因此,大部分國家都希望建立自己的主權AI。

林宜敬進一步表示,目前大型語言模型普遍面臨繁體中文理解不足、臺灣在地知識有限及缺乏臺灣觀點,即使能以繁體中文回答,也可能套用其他國家的政治敘事、法律制度或社會脈絡。數位發展部以近5年高中學測國文科與社會科題目,透過科學的方法,檢驗模型的臺灣語言能力及社會文化理解能力,並透過臺灣社會具一定共識,評估模型對「臺灣價值觀」的理解。

此外,臺灣業者更進一步發展法務、金融、教育、醫療等垂直領域之主權AI模型,納入我國特有的制度、法規、專業知識與實務情境,對於臺灣的價值觀亦有相當好的表現。數位發展部推動臺灣主權AI的目的之一,係希望臺灣本土軟體公司能在這個基礎上,將開發出來的軟體產品化、模組化,並輸出到海外,協助其他國家建立具在地特色的主權AI模型。

根據評測結果,雅婷智慧跟亞太智能機器兩款模型在台灣價值觀正確率獲得滿分,另Google的Gemini 2.5 pro、Gemini 3 Pro low thinking、Gemini 2.5 Flash、鴻海研究院的FoxBrain v2.0也都超過90%。

雅婷智慧廖群董事長、亞太智能機器徐健評商務長、鴻海研究院栗永徽所長及長聯科技董事長李友錚博士等產業代表分享送測經驗與應用成果,他們一致認為臺灣業者未必要在所有通用能力上與國際大型模型競逐,可結合在地知識與產業經驗,發展具有明確應用價值的主權AI產品,並透過第三方評測,讓業者掌握產品優勢與精進方向,使用端也可依據實際場域選擇合適的模型。

「AI履歷健檢」看見自己優勢:https://campaign.1111.com.tw/resume-review/
更多科技工作請上科技專區:https://techplus.1111.com.tw/

 

 

Loading

發佈留言

Back to top button