Hugging Face Kernels 支持 Helion,注意力内核比 FlashAttention 快 1.2 倍
RisingSayak · x · 2026-09-15
Hugging Face 与 Meta 团队联合宣布,高性能内核 DSL Helion 现已获得 🤗 Kernels 项目支持,并发布技术博客讲解完整的构建、调优与分发流程。
- Helion 是「PyTorch + tile」式的高级 DSL,用普通 PyTorch 张量算子描述 tile 级操作来写高性能内核
- 借助 Kernels 项目,开发者可将内核打包发布到 HF Hub,用户免于依赖地狱、可无缝消费
- Helion 提供一流的自动调优(autotune)支持,还可预调优内核配置以降低冷启动时间
- 实测:Helion attention kernel 在 H100 上跨 19 个调优 shape 平均比 PyTorch 的 FlashAttention 快 1.2 倍
「Infra」频道最新
- 传微软 2032 年前要 38GW 数据中心容量,基建竞赛白热化 — VraserX · 2026-09-15
- 孟菲斯居民抱怨马斯克数据中心电厂噪音扰民,隔音墙收效甚微 — LuizaJarovsky · 2026-09-15
- SSD 价格逆势上涨,AI 的存储需求打破数十年降价规律 — lemire · 2026-09-15
- 分析师判断:2027 年是算力紧缺峰值年,供给缓解要到 2028 年 — BenBajarin · 2026-09-15
- 纯 Postgres 驱动 HN 全文搜索:4900 万条数据每次按键都实时查询 — matei_zaharia · 2026-09-15
- 3090 用户求教:加装 3060 能否提升本地视频生成效率 — oodelay · 2026-09-15