北大清华阿里开源 SparkDiffusion,AI 视频生成提速 265 倍
lmoroney · x · 2026-10-01
北京大学、清华大学与阿里巴巴的研究人员开源了 SparkDiffusion,在单张 RTX 5090 上将 720p Wan2.1 14B 模型的视频生成时间从约 4769 秒压缩到 18 秒,提速约 265 倍。
- 技术路线:稀疏注意力 + 少步蒸馏 + FP8 量化
- 代码与权重均已公开
作者观点:速度提升主要利好迭代效率,但创作的核心问题不变——品味、连贯性与故事是否成立;更快的工具奖励的是那些清楚自己想做什么的人。
「多模态」频道最新
- Ideogram 图像编辑模型上线,用户玩起换装实测 — lishali88 · 2026-10-01
- Reddit 用户本地复现 Viggle 风格动作迁移与角色替换效果 — Useful_Ad_52 · 2026-10-01
- Ideogram 4.5 上线 Magnific,全套餐可直接生成并编辑 — aziz4ai · 2026-10-01
- Runway 团队专访:谈实时模型、生成式界面与机器人下一步 — runwayml · 2026-10-01
- NVIDIA 发布 LongLive-Plug:一次蒸馏 LoRA 即插即用于 54 个视频模型 — _akhaliq · 2026-10-01
- 用户用 Opus 5.5 生成 p(doom) 主题音乐视频回应争论 — LilijoySkySeeker · 2026-10-01