CoT 也许只是昂贵接口
meowsterpieces · reddit · 2026-07-14
这篇长文的核心观点是:Chain of Thought 可能正在从“推理路径”退化成一种昂贵的接口形式。作者认为,CoT 虽然可读,但它未必忠实反映模型真实计算过程,而且会把中间推理序列化成 token,带来延迟、成本和上下文占用问题。
作者提出的“latent reasoning”转向
- 一批新方向正在把“思考”移到潜空间,而不是公开生成长文本步骤
- 文中提到的例子包括 Coconut、HRM / HRM Text、RecursiveMAS
- 观点是:语言更适合作为通信与抽象接口,而不是必须承担全部计算过程
黑箱与治理问题
作者指出,如果推理过程越来越多地发生在 latent loop 中,原本就有限的可解释性会进一步下降。对于高风险场景,仅靠模型内部分析可能不够,可能需要一个外层治理/验证循环,例如:
- 符号化或规划式的管理层
- 可审计的 DAG 子目标结构
- 逐节点的确定性验证,如单元测试、约束检查、规则校验
BDH 的位置
文中还讨论了 BDH(Dragon Hatchling):
- 据称某个基于 BDH 的系统在约 25 万个 Sudoku Extreme 题上达到 97.4% top-1 accuracy,且不依赖 CoT 或回溯
- 作者认为 Sudoku 只是约束求解的诊断任务,不足以代表通用推理
- BDH 的研究方向被描述为试图把高带宽 latent 迭代与时间维度上的状态/记忆机制结合起来
文章最后抛出的问题
- CoT 是否会越来越像一种成本高昂的界面,而不是可扩展的推理路径?
- 高风险应用是否最终都需要 DAG + 验证的外层循环?
- 如果内层是 latent recursion,外层应该用什么:DAG、单元测试、形式化规格、proof assistant,还是别的?
「研究」频道最新
- LoMa 论文发布 REALLY HardPairs 数据集,入选 ECCV 2026 — ducha_aiki · 2026-09-11
- JHU 开设全栈机器人学习课:组装机械臂、采数训练部署一条龙 — _krishna_murthy · 2026-09-11
- SyncWorld:少量视觉校准即可零样本模拟机器人跨视角交互 — ChongZzZhang · 2026-09-11
- 狗类 3D 姿态数据集发布,动物动捕研究可用 — ducha_aiki · 2026-09-11
- AI 视频仍穿帮的五个信号:小物件物理、无摄影师与跨镜头光线断裂 — NewPhoneWhotiz · 2026-09-11
- AnyMatch 入选 ECCV 2026,主打无 presenter 设计 — ducha_aiki · 2026-09-11