研究揭示主流大模型普遍偏爱日本文化,偏见源自对齐阶段

i_dg23 · x · 2026-07-21

一项由卡迪夫大学和巴斯克地区研究人员发表的论文,对 24 种语言的 31,680 个文化提示词进行了测试。结果发现,包括 ChatGPT、Claude 和 Gemini 在内的 8 个前沿模型中,有 6 个在回答开放式文化问题时最常提及日本(如传统舞蹈、节日等)。

研究指出,这种对日本文化的偏爱并非源于预训练阶段的原始互联网数据,而是在预训练之后的监督微调(SFT)等对齐阶段产生的。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →