英伟达开源 FlashDreams:给自回归视频与世界模型补上推理运行时
techNmak · x · 2026-09-16
FlashDreams 是英伟达为自回归视频与世界模型提供的运行时基础设施,定位类似 LLM 已有的推理层。它最初是 OmniDreams 闭环驾驶演示背后的优化推理层,现在为 Self-Forcing、OmniDreams、LingBot-World、Waypoint、Causal Wan、FlashVSR 等模型提供统一的流式管线,并支持 local-window 与 WebRTC 交互路径。
工程约束不小:项目在显存至少 80 GB 的 GPU 上开发与测试,默认 CUDA 13,并明确警告消费级与发烧级显卡可能显存不足。
GitHub 仓库:https://t.co/dvjiDWpLkf
「Infra」频道最新
- Transformers 模型可直接在 vLLM 运行,无需移植转换 — pcuenq · 2026-09-16
- 台积电建 20 座厂仍追不上 AI 需求,劳动力短缺成瓶颈 — emmanuelvivier · 2026-09-16
- SemiAnalysis称Nvidia Vera Rubin NVL72智能体推理吞吐每兆瓦最高30倍于Blackwell — emmanuelvivier · 2026-09-16
- Cacheon矿工把MiniMax M3吞吐优化至2337.9 tok/s,据称可多赚61%利润 — JosephJacks_ · 2026-09-16
- 一份文档管道接三家 AI 厂商,Reddit 用户求解一站式自托管方案 — Sad-Razzmatazz-7657 · 2026-09-16
- 纳德拉举例:一座 400-500MW 数据中心让小镇税收涨 12 倍 — rohanpaul_ai · 2026-09-16