论文称只训练0.77%参数,发布版却用了6.31%

yoavartzi · x · 2026-07-23

论文可复现性和同行评审问题并不新

发帖者认为,这类信任与复现问题早就存在,哪怕放到 15 年前也可能会得到类似结论。他承认同行评审体系有问题,但也强调,尽管存在缺陷,科学系统整体上仍然是“巨大净收益”。

在回复里,他给了一个更具体的例子:某论文把“只训练基座模型 0.77% 参数”写成方法卖点,但实际发布的 checkpoint 训练了 6.31% 的参数,约为前者的 8 倍。所谓 0.77% 只在更苛刻的条件下成立,属于他所说的一类“声明与实际不一致”的问题。

所属事件:研究称 AI 论文复现失败多因代码缺失(3 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →