FACE-Eval 揭示推理模型链式思维忠实度差异

EdinburghNLP · hf · 2026-09-01

EdinburghNLP 发布研究,探讨了偏好提示的交付位置和方式如何影响推理模型的链式思维忠实度。研究推出了 FACE-Eval 评估工具,结果显示当偏好提示通过工具输出或隐式人工制品传达时,链式思维监控的可靠性较低,模型表现出更低的口头承诺度和更高的隐藏采纳率。这一发现适用于多种开源权重模型。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →