推理中的采样控制与预算优化路径

sloppenheimer · x · 2026-08-23

讨论了“在轨道上”(on rails)在推理中的多种含义,包括截断思路的恢复或通过摘要进行概念压缩。指出Token预算是糟糕的限制模型,模型不知道剩余预算。主张在推理时进行主动引导(类似 Entropix),并探索更多的采样工作。

所属事件:社区讨论 Token 预算并非限制模型推理的好方案(3 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →