根據數位發展部(數發部)最新報告指出,AI 評測中心已針對 163 款大型語言模型進行評測,涵蓋美國、中國及法國等多個國家。此次評測主要聚焦於模型的繁體中文能力、台灣社會理解及價值觀表現,評測結果預計近期公布,旨在為企業及用戶提供参考。
數據發現:163 款模型評測
數發部長林宜敬於 29 日表示,AI 風險可分為四大層次:傳統資安、資料蒐集、提示詞及觀點與價值觀。AI 評測中心已對全球現有 163 個大型語言模型進行測試,主要偵測其繁體中文理解能力、對台灣社會的理解能力以及對台價值觀。
數據顯示,這些模型在不同層面上的表現存在顯著差異,特別是在台灣社會理解及價值觀方面,部分模型的表現遠不及預期。
林宜敬強調,AI 評測中心將通過測試驗證各主權 AI 是否達到預期目標,預計近期公布成績,作為民眾及企業使用 AI 模型時的參考。
解讀意義:評測結果的重要性
數發部長林宜敬表示,評測結果將幫助用戶更明智地選擇適合的 AI 模型,例如在金融問題上,哪些模型更具優勢;在法務問題上,哪些模型更可靠。這對於提升用戶體驗和降低風險具有重要意義。
數據顯示,許多用戶在選擇 AI 模型時,往往缺乏足夠的信息支持,這導致了不必要的誤差和風險。
林宜敬進一步指出,台灣除了培養具備在地觀點的大型語言模型,還需評測符合台灣價值觀的國外模型,確保其在本地環境中的適用性。
產業影響:主權 AI 布局
數發部長林宜敬表示,台灣將持續推動主權 AI 布局,建立 AI 算力中心,通過 BOO 案打造相當規模的算力中心。這一舉措有望成為台灣新的產業商機。
數據顯示,各國正在積極布局主權 AI,台灣被視為美、中之外的重要合作夥伴,已有多國主動尋求合作。
林宜敬認為,台灣應先協助國內產業建構主權 AI 能力,累積成功經驗後,再將解決方案輸出海外,這將是台灣軟體產業數十年來最重要的成長契機。
從產業面來看,數發部的主權 AI 布局不僅有助於提升台灣在國際市場上的競爭力,還能為國內產業帶來新的增長點。評測結果的公布將為企業和用戶提供可靠的參考,促進 AI 技術的健康發展。
數據背後的啟示
數發部的評測結果揭示了 AI 模型在不同層面的表現差異,特別是在台灣社會理解和價值觀方面。這對於企業和用戶選擇合適的 AI 模型具有重要指導意義。
林宜敬強調,評測結果的公布只是第一步,未來還需不斷監督和改進,確保主權 AI 在本地環境中的適用性和可靠性。
數發部將通過持續的努力,推動台灣在主權 AI 領域的發展,為台灣產業帶來新的商機。
本文改寫整理自公開新聞來源,原始報導由科技新報發布。
常見問題 FAQ
數發部的 AI 評測中心主要評測哪些內容?
數發部的 AI 評測中心主要評測模型的繁體中文能力、台灣社會理解及價值觀表現。
數發部長林宜敬提到的四大層次風險是什麼?
數發部長林宜敬提到的四大層次風險包括:傳統資安、資料蒐集、提示詞及觀點與價值觀。
數發部如何推動主權 AI 布局?
數發部將通過建立 AI 算力中心,推動 BOO 案,打造相當規模的算力中心,以推動主權 AI 布局。
※ 此篇文章由 AI 改寫或生成,內容僅供參考,可能存在錯誤或不準確之處。

