ML 论文为何越写越长?Reddit 热议学界「注水化」趋势
NeighborhoodFatCat · reddit · 2026-10-11
Reddit 用户发帖抱怨机器学习研究正变得越来越「啰嗦」:论文动辄 20、30、40 页纯文本,不仅限于 LLM 领域,连优化方向也是如此,例如 LLaMA 论文就达数十页。
作者提出三个具体痛点:
- 篇幅膨胀:长文让读者难以消化,信息密度反而下降。
- 术语失控:未定义的「疑似新术语」频繁出现,Anthropic 的 transformer-circuits 框架文章被点名——虽有数学公式,但「a lot of...」「we don't feel」等口语化表达混入正式出版物,可读性差。
- 数学弱化:部分研究方向数学推导越来越少,转而依赖「方框图」,而框图遗漏大量细节,几乎无法不经猜测地转译为数学或代码。
评论区围绕学术写作规范、评审标准与 LLM 时代论文膨胀的成因展开讨论。
「研究」频道最新
- 数学博主点评 OpenAI 数论成果:模性证明技巧漂亮,Hodge 猜想论文因符号错误撤回 — ChrSzegedy · 2026-10-11
- Zatom-2 发布:一个模型横跨分子、材料与蛋白质的原子级生成 — rishabh16_ · 2026-10-11
- Andrew White 喊话数学界:AI 能解什么题,别急着划禁区 — andrewgwils · 2026-10-11
- Dietterich:Lean 证明检查器提供外部信息,LLM 证明不是插值 — tdietterich · 2026-10-11
- 1680 组 A/B 实验证明:Unix 经典形式化符号远胜英文提示词 — RandalSchwartz · 2026-10-11
- 审计发现三大 AI 基准有假:SWE-Bench Pro 约 30% 任务损坏 — geoffwolfe · 2026-10-11