模型主动变笨?牺牲知识换取推理能力

bibryam · x · 2026-08-18

文章指出,虽然模型在 AIME 等推理基准上得分飙升,但在 SimpleQA 等事实性召回测试中表现惨淡(Gemini 2.5 Pro 仅 53%,小模型幻觉率超 80%)。这是实验室的权衡:用参数存储世界知识 vs 提升推理能力。每参数约存储 2 比特事实,为了压缩计算和提升推理,厂商正有意削减世界知识。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →