研究揭示主流大模型普遍偏爱日本文化,偏见源自对齐阶段
i_dg23 · x · 2026-07-21
一项由卡迪夫大学和巴斯克地区研究人员发表的论文,对 24 种语言的 31,680 个文化提示词进行了测试。结果发现,包括 ChatGPT、Claude 和 Gemini 在内的 8 个前沿模型中,有 6 个在回答开放式文化问题时最常提及日本(如传统舞蹈、节日等)。
研究指出,这种对日本文化的偏爱并非源于预训练阶段的原始互联网数据,而是在预训练之后的监督微调(SFT)等对齐阶段产生的。
「研究」频道最新
- 斯坦福团队推出全球最快分词器 Gigatoken — StanfordAILab · 2026-07-22
- Tabul AI 推出 Metal TreeSHAP,加速 Apple silicon 上的 Shapley 计算 — Scobleizer · 2026-07-22
- Reddit 转发 OpenAI 的 ChatGPT 广告页面 — EcstaticAsparagus509 · 2026-07-22
- 开源 runtime 让每个仓库自定义 AI 代码审查器 — ibabufrik · 2026-07-22
- DeepSWE:专攻真实 GitHub 场景的 AI 编码智能体评测基准 — pmz · 2026-07-22
- Claude 辅助写成的 Rust 太空经济模拟器,能跑数百艘自治船只 — kalcode · 2026-07-22