WorldCrafter:隐式 3D 感知记忆实现一致性视频世界模型
yshan2u · x · 2026-09-22
WorldCrafter 论文发布,提出一种带隐式 3D 感知记忆(implicit 3D-aware memory)的一致性视频世界模型,用于解决长时视频生成中的场景一致性问题。核心思路是将 3D 空间信息隐式编码进记忆模块,使模型在生成视频时能维持跨帧、跨视角的世界状态一致性。论文链接见原帖。
所属事件:腾讯 ARC 发布 WorldCrafter:隐式 3D 记忆实现视频世界模型长程一致探索(5 条相关)→
「研究」频道最新
- 37 项基准、每模型 13 万次决策:jeff 擅长工具与自动化任务 — multimodalart · 2026-09-22
- Figure Helix 2.5 进驻 30 个陌生家庭,任务成功率 56% 远超从头训练 — lukas_m_ziegler · 2026-09-22
- Decision Index 0.1 发布:向每个模型提问 13 万次横评 30+ 决策模型 — multimodalart · 2026-09-22
- Deep Persona 三层心理架构,让 LLM 角色扮演更贴近真人 — UoHaifa · 2026-09-22
- 大连理工 CARE 框架让 VLA 机器人从失败中学会纠错,成功率提升 15.9 点 — dalian-university-of-technology · 2026-09-22
- Mira-Scene 用像素对齐坐标图解决生成式 3D 场景布局,3D-IoU 提升 39.8% — Yang-Tian Sun · 2026-09-22