CALVER:基于因果验证的大模型推理新方法,突破自我一致性瓶颈

JerzakLabs · hf · 2026-08-06

在处理大模型(LLM)的因果推理任务时,传统的“自我一致性”(即少数服从多数投票)往往会失效:模型常重复相同的混淆错误,或选票分散在多个合理答案中导致错误答案胜出。

研究者提出了 CALVER,一种无需训练的符号验证器。它基于 Pearl 的因果准则(包括分离、后门调整和干预)对结构化推理轨迹进行评分,并直接选择得分最高的候选答案,无需参考标准答案。

在多答案有效的 CLEAR 数据集测试中,CALVER 达到了 42.1% 的准确率,而多数投票、奖励模型和 LLM 裁判的准确率均徘徊在 30% 左右。该方法不仅提升了决策的准确性,且在 CPU 上仅需几毫秒即可完成单次评分。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →