LingBot-Video:30B参数仅激活3B,具身视频模型新架构
alifcoder · x · 2026-07-21
LingBot-Video 旨在提升大型视频模型的生成效率。其旗舰 MoE 模型总参数量为 30B,但生成时仅激活 3B 参数。
- 性能表现:在 100 万 token 序列下,吞吐量达到 30B 稠密模型的 3.18 倍。
- 训练机制:使用了 70,000 小时以上的具身训练数据,并引入了六信号奖励系统。
- 评测得分:在 RBench 评测中取得 0.620 的平均分。
这种通过 MoE 架构提升效率的路径,为具身 AI 视频模型的发展提供了新方向。
「多模态」频道最新
- 分段生成法治 Img2Video 鬼影:3 段 4 秒比 1 段 12 秒更好还快一倍 — Key_Education4018 · 2026-09-11
- 面部捕捉系统v3取得进展,实时人脸重建现曙光 — andrew_n_carr · 2026-09-11
- 单词即出图:Midjourney 提示词系列用苏格兰词 Smeddum 生成风格图 — tisch_eins · 2026-09-11
- 又一例 GPT-6 Astra 一次性生成完整动画,作者直呼不可思议 — paw_lean · 2026-09-11
- 7500万播放的火山喷发视频作者公开 AI 提示词 — charis_ai · 2026-09-11
- Magnific 演示 GPT-6 Astra 联动 MCP:一段对话导演动态图形视频 — charis_ai · 2026-09-11