谷歌开源ML Drift:一套代码搞定四大GPU后端,YouTube Shorts帧延迟降40%
lmoroney · x · 2026-10-09
Google AI Edge 团队以 Apache 2.0 许可开源 ML Drift——LiteRT 内部的 GPU 计算引擎,也可作为独立 C++ 库使用。
- 跨平台统一:一套代码覆盖 OpenGL ES、OpenCL、Metal、WebGPU,加速方案通吃 Android、iOS、Web 与桌面。
- 新能力:支持 5D 张量(旧 TFLite GPU delegate 只到 4D)、张量虚拟化让多后端共享 shader、面向端侧 LLM 的 stage-aware kernel(自动切换 prefill/decode 阶段)。
- 实测收益:YouTube Shorts 分割特效迁移后平均帧延迟最多降 40%;Google Photos 比旧 GPU delegate 快最多 2 秒;Adobe 与 Snap 的端侧功能各提速约 30%。
- 迁移建议:TFLite GPU delegate 不再新增功能,新项目应走 LiteRT ML Drift;已有生产模型可先迁移一个、在真机计时对比,仅当新方案更慢时才保留旧路径。
「Infra」频道最新
- AI 智能体将催生史上最大官僚系统:机器为机器打工 — brucemacv · 2026-10-09
- Bittensor 上的 GPU 云 Lium 半年回购销毁近 270 万美元 SN51 代币 — markjeffrey · 2026-10-09
- 推理平台上线以来供应商翻倍,竞争已压低模型调用价格 — AccBalanced · 2026-10-09
- Liquid Inference 上线一天供应商翻倍,Kimi K3 等价格低于 OpenRouter — AccBalanced · 2026-10-09
- SparseEngine 稀疏优先推理引擎:KV 驱逐下吞吐超 10 倍,Agent 场景提速 2 倍 — Jitai Hao · 2026-10-09
- 数据中心年耗水仅约1立方公里,冲突在选址而非总量 — AryHHAry · 2026-10-09