Honeycomb 发布:六平面固定大小场景记忆,让视频世界模型长程生成不失一致
Jack Wei Lun Shi · hf · 2026-10-03
视频世界模型在长程生成中需要持久的场景记忆,而现有方案累积 RGB 观测或隐特征,存储随生成不断增长。Honeycomb 提出基于 HexMemory 的低秩表示:用六个空间与时空平面构成固定大小记忆。
工作方式:前馈 writer 将每个生成片段映射为新的平面特征;随空间覆盖或时间范围扩大,对旧平面做 warp 保持维度不变,再通过置信度加权池化和可学习残差修正融合新特征;reader 从 HexMemory 检索隐变量条件化后续生成。writer 只处理新片段观测,避免逐场景优化和重复处理全部历史。
在 WorldScore 与 RealEstate10K 上的实验显示生成质量强、重访一致性稳健,且 HexMemory 特征存储在整个生成过程中保持恒定。代码与可视化已开源。
「多模态」频道最新
- 创作者用 ML 学习真人运动信号,为抽象图像注入「生命的错觉」 — pixlpa · 2026-10-03
- Runway 世界模型转战机器人:Praxis-1 只需几分钟演示数据 — c_valenzuelab · 2026-10-03
- 博纳 AI 电影《三星堆:未来启示录》过审,10月23日全国上映 — lmoroney · 2026-10-03
- AI 导演 Junie Lau 登上 Forbes,新片《Goldfish Mayhem》下周首映 — JunieLauX · 2026-10-03
- fal H3 Max 视频生成新增首/中/尾帧关键帧控制 — OdinLovis · 2026-10-03
- 在 ChatGPT Dots 里跑 Blender,AI 自己建模绑骨还配了乐 — OpenAIDevs · 2026-10-03