Veda 稀疏注意力 ComfyUI 节点:12GB 显存渲染 5 秒视频快 2.9 倍
lmoroney · x · 2026-10-06
由 ByteDance、港大与中科大组成的 Veda 团队(ICML 2026)为 MiniMax H3 视频模型发布了官方 ComfyUI 节点,用稀疏注意力大幅提速:
- 原理:一个学习得到的小型预测器对 attention map 按块(tile)打分,只保留约前 10% 的块,配合自定义 kernel 只读取这些块;模型权重完全不动,LoRA、微调与量化版 H3 checkpoint 都能继续用。
- 实测:在 12GB 的 RTX 5070 上,用 8 步 Turbo LoRA 渲染 5.2 秒 1344x768 视频,从 342 秒降到 130 秒,端到端约快 2.9 倍。
- 注意:预测器标注为 preview,训练只覆盖少量分辨率与时长。
- 验证方法:作者建议用 Ctrl+B 旁路该节点、同 seed 跑全注意力版本,两段对比看画质损失是否可接受。
「Infra」频道最新
- Starlink 在轨卫星超 1.1 万颗,占全球活跃卫星约三分之二 — XFreeze · 2026-10-06
- Ben Bajarin:Agentic AI 推动数据中心 CPU 需求,关键在 Scale-Up 域设计 — BenBajarin · 2026-10-06
- llama.cpp 作者:Qwen3.8-27B 用户可换 DFlash 投机解码再提速 — victormustar · 2026-10-06
- GLM 5.3 全量 NVFP4 可在 4 张 B200 或 H200 上部署 — TheZachMueller · 2026-10-06
- 网友把 GLM-5.3 无审查版量化成 MXFP4,AMD GPU 可跑 — bakatristan · 2026-10-06
- 传 OpenAI 数千万美元算力几天内攻克 Navier-Stokes,算力即胜负 — haider1 · 2026-10-06