LLM预测能力研究:激活比文字更可靠
burny_tech · x · 2026-07-11
Goodfire 发布了一篇关于 LLM 预测/forecasting 的论文,题目是 “What LLM Forecasters Know but Don’t Say”。
文章指出:LLM 预测器常常显得很自信,但校准并不稳定;它们的 chain-of-thought 也未必能揭示预测为何变化。研究发现,模型内部激活值 比输出文字更能反映真实状态。
论文通过小型 probe 读取这些激活,来:
- 提升置信度校准
- 检测“无声”的证据变化
- 在推理开始前就部分恢复预测结果
作者认为,这是一种更便宜、也更忠实的 LLM 预测审计方式。
「研究」频道最新
- Nature 新研究实现全身器官细胞活动成像,揭示跨器官体级回路 — arjunrajlab · 2026-09-11
- Skyfall GS 登场:用 Flux 提升 Gaussian Splatting 精修质量 — ducha_aiki · 2026-09-11
- 一万个智能体能否突破反向传播,找到更好的学习算法 — SeunghyunSEO7 · 2026-09-11
- Apodex 发布 TRACES 标准:用 423 个真实问题评测"发现型 AI" — Faheem_uh · 2026-09-11
- 科学没有标准答案:TRACES 用六维度评估 AI 过程而非结果 — Faheem_uh · 2026-09-11
- Apodex 推出 TRACES 基准:不打标准答案,专测 AI 探索未知的能力 — Faheem_uh · 2026-09-11