开源交互世界模型LingBot-World 2.0
FellMentKE · x · 2026-07-12
LingBot-World 2.0 试图把“生成视频片段”推进到“可持续交互的世界”。作者强调,真正值得关注的不是能否撑满 1 小时,而是长时程交互是否会成为新的 AI 基准。\n\n这项工作主打开放:weights、代码和 agentic harness 都已释放,方便研究者和开发者直接分析,而不只是看演示。论文描述的核心设计包括:\n\n- Brain–Cerebellum 架构:由视觉语言模型提出新的事件卡片,再由世界模型把事件渲染进环境中,让内容持续生成。\n- 更强的交互空间:不只支持移动,还扩展到战斗、射箭、施法、射击、环境变化和文本驱动事件。\n- 长时程稳定性:在实时响应下,实现了约 720p / 60 fps 的小时级生成,作者认为这来自因果训练策略,而不只是单纯拉长生成时长。\n\n整体来看,这是一项围绕“可长期演化的交互式世界”展开的研究,重点在于一致性、交互能力和开放复现。
所属事件:蚂蚁开源LingBot-World 2.0交互式世界模型(15 条相关)→
「多模态」频道最新
- 零编程经验者用 ChatGPT 开发 ComfyUI 安卓客户端将上架 — ComfierUI · 2026-09-11
- FastH3-Live 升至 22fps:加速节点实测与 ComfyUI 显存避坑 — spartong945 · 2026-09-11
- Midjourney 风格参考分享:--sref 2912175708 — tisch_eins · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11
- Hailuo 转推:MiniMax H3 MAX 一发生成 15 秒美食动画短片 — Hailuo_AI · 2026-09-11
- MiniMax Music 制作工具包 2.5 发布,新增完整母带处理链 — Vivid_Promise1700 · 2026-09-11