Toby Ord 量化并行 swarm 扩展:16 倍规模仅等效思维链 4.9 倍
tobyordoxford · x · 2026-09-22
哲学家 Toby Ord 基于 OpenAI GPT-5.6 发布页上公开的基准数据,对「扩大并行采样规模(swarm scaling)」与「拉长思维链」两种扩展路径的收益做了定量比较。
- 他在前一帖中推导出:并行扩展的收益曲线斜率约为序列扩展的 57%,即缩放指数 λ = 0.57。
- 由此得出结论:把 swarm 规模扩大 16 倍,效果只相当于把思维链长度扩大 16^0.57 ≈ 4.9 倍。
- 他补充指出,OpenAI 在 GPT-5.6 发布页上确实提供了 3 个可用于此类拟合的基准数据点。
这一分析意味着在同等算力下,延长推理链的边际收益高于横向铺开并行采样。
所属事件:牛津 Toby Ord 量化 Swarm Scaling:集群扩容性价比远逊拉长思维链(10 条相关)→
「研究」频道最新
- 人类视频成机器人预训练底座:有效经验=小时数×每小时信息密度 — rohanpaul_ai · 2026-09-22
- Maxinsights 深度报告:Physical AI 数据缩放定律,百万小时之后拼信息密度 — rohanpaul_ai · 2026-09-22
- 4B Qwen 经 SFT+RL 优化查询计划:Join Order Benchmark 提速 81%,成本仅 1200 美元 — JeremyCMorgan · 2026-09-22
- 曝 OpenAI 内部模型已解决超百个数学长期开放难题 — inductionheads · 2026-09-22
- Jayce 原型记忆框架:本地 LLM 即时学新事实,比反向传播快 1.6-4 倍 — kavanutz · 2026-09-22
- 斯坦福清华研究:LLM 隐状态中自发涌现类多巴胺奖励神经元 — chrismattmann · 2026-09-22