自测预注册实验85.7%曾p-hack配置被阻止

krisgligoric · x · 2026-07-06

研究团队自己也按该协议执行并预注册了实验。结果显示,85.7%曾对前代模型p-hack的配置,在使用下一个合格模型时被成功阻止,验证了方法在自我约束上的有效性。

所属事件:研究提出LLM预注册协议以遏制评测p-hacking(7 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →