HF 开源 kernels 库:Jinja 模板让浏览器自动编译最快 GPU kernel
nicodotdev · x · 2026-09-04
Hugging Face 工程师发布 @huggingface/kernels 两天后放出深度技术解析,讲清这个浏览器端 GPU kernel 库的设计原理。
- 为什么用 Jinja 模板而非直接发布 WGSL 文件:同一算法在不同 GPU 上最优实现不同,模板可在浏览器端按具体 GPU 编译出最快的 kernel
- 实测效果:用约 20 行 JS 在 GPU 上跑 attention;一次 matmul 驱动超 100 万像素动画,帧率 400 fps,而纯 JS 实现只有 6 fps
- Fleet 计划:用户运行 benchmark 提交自己 GPU 的数据,帮助团队为每类设备调优 kernel
作者附上完整视频、博客、Playground 和 npm 包链接,可直接上手体验。
所属事件:HF 深解析开源 kernels 库:浏览器自动编译 GPU 内核(2 条相关)→
「Infra」频道最新
- Altman 称 3.8 万次 ChatGPT 查询用水量才等于一颗杏仁 — ControlCAD · 2026-09-05
- Perplexity CEO 谈本地 AI 硬件:与 Nvidia、Apple 合作,主张本地+云混合路线 — Kr00ney · 2026-09-05
- 分析师对比苹果与英伟达:以资产负债表作为竞争武器 — BenBajarin · 2026-09-05
- Anima 创业公司要做物理世界基础模型,跨物理域训练反超单域模型 — Latent Space · 2026-09-05
- gemma 3 31B 跑分遇阻,开发者 fork vLLM 自写补丁突破速度 — abhijithneil · 2026-09-04
- 投资人 Gavin Baker:数据中心是美国工人阶级最好的事 — GavinSBaker · 2026-09-04