模型为何脑补而非承认看不出来:评测只奖励正确不奖励诚实
ziv_ravid · x · 2026-07-04
「Mirage(海市蜃楼式脑补)」研究作者解释模型为何倾向脑补而非承认「我看不出来」:这是被评测机制塑造的。现有 benchmark 只考核答案正确性、不考核是否有依据,因此基于先验去猜的期望收益为正,弃答收益为零——幻觉在当前评测体系下其实是最优策略。
「研究」频道最新
- VidMap 用 RoMa 粗匹配全帧、精细匹配仅限关键帧 — ducha_aiki · 2026-09-11
- Bug Hunt Bench 作者补充:榜单噪声幅度约 2-3 分 — PawelHuryn · 2026-09-11
- 台球计算模型登 PNAS:二维系统已存在不可判定性,可跑通用计算机 — eigensteve · 2026-09-11
- 新研究:从仿射变换与重力线索求解绝对位姿 — ducha_aiki · 2026-09-11
- LoMa 论文发布 REALLY HardPairs 数据集,入选 ECCV 2026 — ducha_aiki · 2026-09-11
- JHU 开设全栈机器人学习课:组装机械臂、采数训练部署一条龙 — _krishna_murthy · 2026-09-11