研究揭示主流大模型普遍偏爱日本文化,偏见源自对齐阶段
i_dg23 · x · 2026-07-21
一项由卡迪夫大学和巴斯克地区研究人员发表的论文,对 24 种语言的 31,680 个文化提示词进行了测试。结果发现,包括 ChatGPT、Claude 和 Gemini 在内的 8 个前沿模型中,有 6 个在回答开放式文化问题时最常提及日本(如传统舞蹈、节日等)。
研究指出,这种对日本文化的偏爱并非源于预训练阶段的原始互联网数据,而是在预训练之后的监督微调(SFT)等对齐阶段产生的。
所属事件:研究称主流大模型在文化问题上普遍偏袒日本(2 条相关)→
「研究」频道最新
- 可编程元胞自动机 PCA:让每条规则变成可读代码 — Amidos2006 · 2026-09-11
- GEVIBench 发布:系统对比各类电压指示器的综合基准 — drmichaellevin · 2026-09-11
- 高斯混合建模光传输方程,INRIA 新方法加速全局光照求解 — ssh4net · 2026-09-11
- Goodfire 解读可解释性:海贼语数学模型如何只学数学不学海盗腔 — Machine Learning Street Talk · 2026-09-11
- P vs NP 恐难被 AI 攻破,fortnow 点名 NP vs L 等更可行难题 — fortnow · 2026-09-11
- MaP-WAM 用记忆驱动规划攻克非马尔可夫机器人操作难题 — Sizhe Zhao · 2026-09-11