前 CoT 时代的「手动思维链」:老研究者回忆早期玩法
gandamu_ml · x · 2026-09-28
gandamuml 回忆在 CoT 正式出现之前, 他会有意让模型先输出对后续推理有益的内容再给出最终答案——相当于「手动 CoT」, 但当时模型并未针对这种用法专门训练。他表示这在圈内是有人讨论过的做法, 是 test-time compute 概念早期形态的一手轶事。
「模型」频道最新
- OpenAI 现神秘模型代号 gpt-7-quetzalcoatl,定价 $0.05/$0.50 — arthurcolle · 2026-09-28
- 爆料:Gemini 4 Pro 疑以「Gemini 3.8 Flash」之名现身 Arena 测试 — DaniDFdesign · 2026-09-28
- 小米 MiMo-V2.6 修复工具调用重复:RL 奖励盲区,仅花 4% 成本 — LegacyRemaster · 2026-09-28
- 斯坦福给 Unitree G1 装上 OpenAI 模型大脑,零训练搞定陌生厨房 — alex_verem · 2026-09-28
- Tibo 连续暗示 OpenAI「o」项目,观察者预测 Astra 即将更新 — kimmonismus · 2026-09-28
- 算账:opencode 10 美元月费下小米 MiMo 请求量竟是 DeepSeek 数倍 — lxfater · 2026-09-28