scaling01 补刀:并行扩展瓶颈在时间而非 token,效率再高也要一年
scaling01 · x · 2026-09-19
延续此前对测试时算力的争论,scaling01 补充回应:「token 效率」是个伪命题,没人否认并行更费 token,真正的问题是时间——即使并行方案在 token 上省 100 倍,串行跑完仍然要花一年,这在实践中不可行。
「模型」频道最新
- Context7 实测 Jev:快 10-170 倍、便宜 3-20 倍,但复杂推理不行 — gaganghotra_ · 2026-09-19
- Jev 对弈 GLM 5.3:29 步被将死,但每步仅 0.3 秒、成本低 80 倍 — nutlope · 2026-09-19
- Grok Transcribe 2.0 准确率翻倍,0.1 美元/小时居 32 模型之首 — XFreeze · 2026-09-19
- Jev 补齐开源与视觉短板:任意 HF 模型一键 Jev 化并上线 Featherless — Aizkmusic · 2026-09-19
- Jev 可替代本地模型做低延迟应用,开源 RLCD 版本可期 — HankYeomans · 2026-09-19
- 两年后应验:研究者重申基础模型将如 RISC/CISC 走向分化 — lateinteraction · 2026-09-19