斯坦福研究:本地模型每焦耳准确率16个月提升18倍
Azaliamirh · x · 2026-09-12
研究者指出推理格局正快速走向本地与云端混合。其测算显示,本地模型的「每焦耳准确率」(accuracy per joule)在16个月内提升了18倍,其中5.9倍来自硬件进步、3.0倍来自模型本身的改进。该工作由 Stanford 团队(Azaliamirh、Avanika、Jon Saad-Falcon、Hazy Research、John Hennessy 等)完成,并获英国《金融时报》深度报道。作者认为世界对中心化云端 AI 的依赖正持续下降,端侧本地推理将扮演越来越重要的角色。
「Infra」频道最新
- DeepSeek v4.1 Flash 发布首日即适配 vLLM,覆盖六款 NVIDIA GPU — woosuk_k · 2026-09-12
- 开源 Plano:两行配置实现按意图自动路由 LLM 省 50% 账单 — Roger_M_Taylor · 2026-09-12
- Netflix 工程师开源 Headroom:代理 Token 用量最高省 95% — Roger_M_Taylor · 2026-09-12
- DSV4.1 把全局 KV 压到 890 字节,HBM 需求争论再起 — teortaxesTex · 2026-09-12
- Polymarket 给 AI 泡沫破裂定价:2026 年底前仅 12% 概率 — Polymarket · 2026-09-12
- SGLang 深度适配 DeepSeek V4.1 Flash,24 小时内冲到 873 tok/s — BanghuaZ · 2026-09-12