人类逻辑顺序未必最适合模型推理
furongh · x · 2026-07-06
一个出人意料的发现:人类的逻辑顺序并不总是对模型最优。预训练的扩散 LM 可能沿一条不同于人类解题轨迹的路径推理得最好。这指向一个新方向:不只是追求类人 CoT,而是"模型感知"的思维排序。
所属事件:SAS让扩散语言模型学会自感知调度(15 条相关)→
「研究」频道最新
- Google DeepMind 分享 Project Genie 的创作者协作幕后 — alexanderchen · 2026-07-21
- Nat Lambert 反驳 RL 蒸馏直接用最强模型当老师 — natolambert · 2026-07-21
- 线程称 GPT-5.6 Sol 帮忙构造出 Jacobian 猜想反例工厂 — LucaAmb · 2026-07-21
- TimeLens2 以 4B 和 8B 模型拿下 7 项视频定位 SOTA — _akhaliq · 2026-07-21
- 真实数学进展常靠推翻旧直觉 — LucaAmb · 2026-07-21
- EPO 用边缘对齐同时优化 3D 模型位姿与深度 — ducha_aiki · 2026-07-21