LLM 概率自相矛盾:P(下雨)=0.7 而 P(不下雨)=0.2
Moh1tAgarwal · x · 2026-09-05
研究者 Suproteem Sarkar 举了一个检验语言模型概率一致性的反例:问模型「明天下雨的概率」,再问「明天不下雨的概率」,两者理论上必须相加为 1;但模型可能给出 P(rain)=0.7 与 P(no rain)=0.2 的矛盾答案。该例子指向 LLM 概率输出的校准与一致性问题。
「研究」频道最新
- Anima 创办公司后首期播客:5 万亿上下文与 4D 物理预测 — AnimaAnandkumar · 2026-09-05
- Uno 用 AR 架构无损并行采样,速度超 EAGLE-3 全部扩散 LLM — HongyiWang10 · 2026-09-05
- 新方法突破以往自解释训练的窄泛化:未定向训练也提升 hint 评测 — a_karvonen · 2026-09-05
- 从行为调查中生成两类自解释训练目标:反事实预测与开放式解释 — a_karvonen · 2026-09-05
- Anthropic Fellows 训练模型解释自身行为,泛化到未见评测 — a_karvonen · 2026-09-05
- Deep Learning Weekly 第471期:Claude Fable 5.1 发布与生产级 LLM 评测 — dl_weekly · 2026-09-05