今年 4 月,一項來自英國卡迪夫大學和西班牙巴斯克大學的研究,徹底顛覆了人們對 AI 的既有認知。研究人員發現,主流大型語言模型並非如外界所認為的那樣,主要反映西方、尤其是美國的價值觀,反而對日本及其文化表現出異常的喜愛。
事實陳述
這項研究針對全球 8 款大型語言模型和 24 種語言進行了測試,涉及 11 項廣泛主題、66 項子主題,共計 31,680 道文化相關開放式問題(Culture-Related Open Questions,CROQ)。研究結果顯示,8 款模型中有 5 款在所有非母語相關國家中最偏好日本,而只有 2 款較偏好美國。
受測模型包括 GPT-4o mini(OpenAI)、Gemini 2.5 Flash(Google)、Claude 3.5 Haiku(Anthropic)、Llama 4 Maverick(Meta)、Command-R(Cohere)、Magistral(Mistral AI)、DeepSeek-V3.2-Exp(DeepSeek)、Qwen2.5(阿里巴巴)。其中,GPT-4o mini 在作答內容中提及日本多達 944 次。
各方反應
這項研究引起了業界的廣泛關注。一些專家認為,這種現象可能反映了日本在全球文化中的重要地位,尤其是在動漫、電影、文學等領域的影響力。另一些則指出,這種偏好可能是由於微調過程中使用的資料集偏向日本文化。
例如,研究人員將僅以原始網路資料進行預訓練的基礎模型,與經過指令微調的模型進行對比。結果顯示,基礎模型在各國之間的文化提及次數和分布相對平均,但經過監督式微調後,特定偏好被放大,特別是對日本和美國的文化偏好。
背景補充
研究人員進一步發現,即使提示詞使用的語言與日本無明顯連結,模型仍不斷提及日本和日本文化。這表明這種偏好並非由使用者造成,而是深深烙印在模型中。例如,以孟加拉語、加泰隆尼亞語、加利西亞語、豪薩語或斯瓦希里語向 AI 提問,日本仍會頻繁出現。
此外,當模型被問到沒有明確指定地點的 CROQ 時,它們往往不會根據提問的語言背景,而是依賴模型內部對於「強勢文化」的認知來作答。日本和美國在全球具有極高的文化影響力,即使提問語言(例如西班牙語或阿拉伯語)與日本毫無地緣關聯,模型仍會系統性地依賴並呈現這類具備文化優勢的國家。
從產業面來看,這種對日本文化的偏好可能是由於微調過程中的資料集選擇,而非原始訓練資料本身的偏差。這提醒我們,AI 的回答並不能完全代表世界全貌,需要更多元、平衡的文化視角才能全面理解不同國家的聲音。
如果 AI 使用者是個哈日族,看到 AI 這麼偏愛日本,相信會忍不住會心一笑,彷彿與人們對話的 AI 也懂追番、會看日劇、充滿職人精神。這項研究也提醒人們,AI 的回答未必代表世界全貌,需要擁有多元、平衡的文化視角,才能理解不同國家的聲音。
文章看完覺得有幫助,何不分享給身邊的朋友,一起探討 AI 背後的文化偏好?或者,如果你對這個主題有更深的了解,歡迎在留言區分享你的看法。
本文改寫整理自公開新聞來源,原始報導由科技新報發布。
常見問題 FAQ
這項研究的目的是什麼?
這項研究旨在探索主流大型語言模型在文化偏好上的特徵,特別是它們如何反映不同國家的文化。
哪些模型參與了測試?
參與測試的模型包括 GPT-4o mini(OpenAI)、Gemini 2.5 Flash(Google)、Claude 3.5 Haiku(Anthropic)、Llama 4 Maverick(Meta)、Command-R(Cohere)、Magistral(Mistral AI)、DeepSeek-V3.2-Exp(DeepSeek)、Qwen2.5(阿里巴巴)。
為什麼模型會特別偏好日本?
研究發現,這種偏好可能是在微調過程中使用的資料集偏向日本文化,而非原始訓練資料本身的偏差。
※ 此篇文章由 AI 改寫或生成,內容僅供參考,可能存在錯誤或不準確之處。

