微博 AI 提出 CLR 框架,测试时推理准确率提升 27%

pmttyji · reddit · 2026-08-17

微博 AI 提出 Claim-Level Reliability Assessment (CLR),一个无需训练的测试时计算框架。CLR 将推理轨迹压缩为关键的决策级声明,通过寻找否定证据来验证逻辑锚点,利用“构造正确解需要完美路径,但反驳只需一个致命缺陷”的不对称性,有效抑制错误共识。实验表明,在匹配预算下,CLR 普遍优于 pass@1 和自洽性方法;在 GPT-OSS-20B/CMIMC25 任务上,CLR 比 pass@1 高出 27.15 个百分点,且节省了 37.0% 的 Token。

所属事件:微博 AI 提出 CLR 框架大幅提升推理准确率(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →