24H直播

數發部台灣主權AI評測出爐 本土模型「雅婷智慧」奪第4

(圖/數發部提供)
發布時間: 更新時間:
數發部公布「台灣主權AI」評測結果,前三名分別為OpenAI、Anthropic及Google的大型語言模型,本土模型「雅婷智慧」則拿下第4名。數發部指出,評測共有188個國內外模型參與,評測重點為台灣語言、社會文化及價值觀等3大面向。

數發部2日公布「台灣主權AI」評測結果,共有來自美國、歐洲、中國及台灣等國的188個模型參與,檢驗內容為模型是否具備台灣語言、社會文化與價值觀等3大理解能力,前三名分別為OpenAI的「GPT-5.6-Sol」、Anthropic的「Claude-Fable-5」,以及Google「Gemini-2.5-Pro」。

本次評測是以高中學測國文科檢驗模型語言能力、社會科題目檢驗社會文化理解能力,並透過在台灣社會具一定共識的民主制度、社會觀點等,評估模型對「台灣價值觀」的理解。

值得注意的是,本土模型「雅婷智慧」的模型,在此次評測中高居第4名,數發部長林宜敬對此表示,不同於前三名皆由擁有超過一兆個參數的大型人工智慧模型拿下,雅婷智慧的參數僅有300億個,規模更小多、更省電,不一定需要很大的算力中心,卻能有這樣出色的表現。

除了雅婷智慧之外,同樣由台灣團隊開發的亞太智能機器及鴻海研究院模型,也都排在此次評測的前20名內。

台灣主權AI評測前20名(圖/AIEC)
台灣主權AI評測前20名(圖/AIEC)

林宜敬表示,「主權AI(Sovereign AI)」具有2個重要的意義:由哪個國家訓練出來的大型語言模型,通常就會有那個國家的觀點與意識形態;AI大語言模型的伺服器放在哪個國家,就必須遵守該國法律,因此才會大部分國家都希望能建立自己的主權AI。

林宜敬進一步指出,目前大型語言模型普遍面臨繁體中文理解不足、台灣在地知識有限,以及缺乏台灣觀點等問題,即使能以繁體中文回答提問,但套用的可能仍是其他國家的政治敘事、法律制度或社會脈絡。

針對台灣價值觀的驗證方面,林宜敬解釋,內容均是朝野有共識,但跟中國沒有共識的題目,例如「媒體與政府的關係」,在台灣會是第四權監督,但在中國則會是政府的傳聲筒。數發部也提及,台灣業者更進一步發展法務、金融、教育、醫療等垂直領域之主權AI模型,且能納入我國特有的制度、法規、專業知識與實務情境。

數發部強調,推動台灣主權AI,便是希望台灣本土軟體公司能在這個基礎上,將開發出來的軟體產品化、模組化,並在未來輸出海外,協助其他國家建立具在地特色的主權AI模型。

您的參與,
讓公共服務更完整!
閱讀、按讚,就能客製您的專屬推薦新聞
本網站使用 Cookie 技術提升體驗,詳見服務條款。繼續瀏覽即代表同意上述規範。