LLM 置信度与准确性无关:坚定语气不等于答案正确

ClickOk5811 · reddit · 2026-08-28

作者分析了 40 条分类任务输出,比较了使用模糊限定词(如“可能”)与绝对肯定表述的准确性。结果显示,无论语气如何,错误率均为六分之一左右。限定词并未有效追踪实际不确定性,更像是一种文风习惯。这表明将模型措辞作为可靠性信号是靠不住的,不应因“听起来确信”而盲目信任。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →