SandAI 发布 114B 音视频生成模型 MAGI-2 预览版
Nice_Amphibian_8367 · reddit · 2026-08-05
SandAI 发布了 MAGI-2 Preview,这是一个统一的音视频生成模型。
- 架构设计:总参数量达 114B,但每个 token 仅激活约 6B 参数。采用 MagiMoE / 多头潜变量 MoE 架构,比直接照搬 LLM 风格的 MoE 更适配视频生成。
- 生成机制:使用 FlowUniPCMultistepScheduler 进行流匹配采样,而非 MAGI-1 中的自回归分块方法。生成分为两个阶段:先进行预览去噪,再由 refiner 提升至 1080p。
- 功能支持:支持文本生视频(T2V)和图生视频(I2V),并能同步生成音频。
- 开源情况:目前发布的代码仅限推理使用。
所属事件:Sand.ai开源千亿参数音视频模型MAGI-2预览版(2 条相关)→
「多模态」频道最新
- BFL 发布 FLUX 3 视频模型,官方承诺将推出开源权重版 — cloneofsimo · 2026-08-05
- 字节跳动将 Seedance 视频模型植入 Gauth,自动生成教育动画 — Economy_Cicada8756 · 2026-08-05
- 实测开源 AI 绘本工作站:端到端交付完整产品 — sujingshen · 2026-08-05
- 用Minimax h3与GLM 5.2生成10分钟《宋飞正传》AI长视频 — nathandreamfast · 2026-08-05
- MiniMax 视频模型实测:用 4 张图生成汤姆·赫兰德吃街头小吃 — CurieuxExplorer · 2026-08-05
- MiniMax H3 开启早访:主打多模态生成与精准场景编辑 — HeyAmit_ · 2026-08-05