COLM 杰出论文:消息传递让 LLM 推理摆脱长思维链瓶颈
yoavartzi · x · 2026-10-07
COLM 2026 公布三篇杰出论文,其中一篇是《Message Passing Enables Efficient Reasoning》(arXiv:2607.01077)。
论文提出 MPLM(Message Passing Language Models) 框架:不同于串行 CoT 和 fork-join 式并行扩展(线程间不通信),MPLM 让多个 LLM 线程通过轻量级 send/receive 原语直接通信,从而:
- 降低通信成本,避免冗余的上下文共享;
- 支持抢占(preemption),线程可根据同伴的部分结果提前终止无望分支。
实验上:在数独任务中 MPLM 所需上下文渐近地小于串行 CoT 和并行 fork-join,微调单个模型即可解出 25×25 数独(标准 CoT/FJ 及不带工具的前沿推理模型都难以做到);在 3-SAT 任务中,抢占机制通过及时终止无望分支提升效率。
「研究」频道最新
- HAIPS@COLM 2026 工作坊聚焦语言模型的人本隐私与安全 — tianshi_li · 2026-10-07
- CUAWright 论文:只用终端命令,computer-use agent 胜过 GUI 方案 — ysu_nlp · 2026-10-07
- AI 年度十佳论文揭晓:Rulin Shao 一人独占两篇,皆为一作 — ShayneRedford · 2026-10-07
- Paradigm 发布数学推理模型:7 项高难基准评测套件全开源 — tensorqt · 2026-10-07
- Paradigm 揭秘后训练关键:程序生成+LLM 出题的互补合成数据组合 — tensorqt · 2026-10-07
- Paradigm RL 训练细节:用价值模型解决 credit assignment,上下文扩至 131k — tensorqt · 2026-10-07