鞍点散射让推理模型尝试更多解:Lyapunov 指标可量化
wgilpin0 · x · 2026-09-09
作者团队进一步解释机制:高维动力学像「弹珠盘」游戏——轨迹从相近起点出发收敛到同一答案,但在鞍点处被不同的错误答案散射而走不同路径。「鞍点散射」让推理模型检查更多可能的解。他们计算快 Lyapunov 指标来衡量轨迹的瞬态混沌强度,发现其与模型收敛前访问的候选解数量正相关。
所属事件:研究用分形盆地理论解释推理模型过度思考(13 条相关)→
「研究」频道最新
- Lila Sciences 联合创始人 Kompa 入选 MIT TR35,估值超 13 亿美元 — tw_killian · 2026-09-09
- 100 个规则验证器加 300 项任务,团队为视频模型打造可验证 RL 训练配方 — DanielKhashabi · 2026-09-09
- 隐私问题出事才被想起,研究者重提 2022 年差分隐私预训练警示论文 — thegautamkamath · 2026-09-09
- RL 中的局部坏行为不会泛化出「涌现性错位」 — 1a3orn · 2026-09-09
- 思辨:能力 RL 环境中的模型可能学到「能用就用」的最笨启发式 — 1a3orn · 2026-09-09
- 实测拆解 6 年预训练进步:数据贡献 12 倍算力收益,模型仅 3.7 倍 — sebkrier · 2026-09-09