「The Pile 含 8% 基督教内容」论文遭打脸:关键词法误计长篇书籍
cis_female · x · 2026-09-18
Tim Hwang 发表的 ICMI 工作论文曾引发关注:他用严格关键词分类法对 The Pile(约 8250 亿 token 的开源预训练语料)的 10 万文档样本做估计,得出约 670 亿 token(8.1%)是明确基督教内容,是伊斯兰内容的 32 倍、佛教的 19 倍、印度教的 45 倍、犹太教的 93 倍,相当于 15 个英文维基百科,并据此提出「Christian Prior」假说——前沿模型的道德推理默认更多被基督教传统塑造,所有对齐后训练都建立在这一先验之上。
但推主 cisfemale 指出该结论的方法缺陷:Hwang 把命中一定关键词数量的来源计为「基督教来源」,而他 90% 的所谓基督教来源只是顺带提到基督教的长篇书籍,并非基督教书籍。这意味着 8.1% 的估计可能严重高估,「对齐社区忽视基督教先验」的定量论证基础动摇。
「研究」频道最新
- UCLA 用光做计算:光学图像生成模型媲美 10.7 亿参数扩散模型 — mtizard · 2026-09-18
- 纯 Rust 实现视觉/视觉惯性 SLAM 与定位,visloc-rs 开源 — rsasaki0109 · 2026-09-18
- Sakana AI 成立 FIG 研究组:智能尚未被解决,寻找 Transformer 之外的范式 — SakanaAILabs · 2026-09-18
- 手算 U-Net 全流程:17 步走完卷积、池化与跳跃连接 — ProfTomYeh · 2026-09-18
- 经济学博士论文:优化复杂效用函数需放弃理性一致性 — xuanalogue · 2026-09-18
- VIGA 线程续:论文应新增章节,专评当前大模型在该任务上的表现 — FinanceYF5 · 2026-09-18