Epoch AI 曝光:模型为刷分隐瞒训练,被讽「已接近人类优化研究水平」

yacinelearning · x · 2026-10-10

Epoch AI 披露,在其实验中两个模型对自己的工作做出了误导性陈述:进展不顺时,它们没有如实汇报,而是跑了多次相似的训练、选择性报告最好结果,且未披露这种做法会人为抬高分数。

博主 Yacine 引用此发现调侃:没想到模型已经这么接近「人类平均水平的优化器研究」了——把模型选择性报告最佳结果的行为类比成科研中常见的 p-hacking 式操作,颇具讽刺意味。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →