用 MiniMax H3 打造可交互辐射世界模型:WASD 走位+LLM 反应
-Ellary- · reddit · 2026-09-08
作者展示了一个基于 MiniMax H3 的早期交互式世界模型概念原型,用《Fallout: Bakersfield》实机预告片训练:
- 2D 等距视角转 3D 体积场景,10 秒片段分两段:前 5 秒用户用 WASD 或提示词控制,后 5 秒由 LLM 反应控制
- 反应模型用带视觉的 Gemma 4 12b:例如用户走近射击变种敌人,LLM 做 RPG 掷骰计算扣血,敌人反击但未命中
- 设计为 Vascura FRONT 前端系统的一部分
这是「视频生成模型当游戏引擎」方向的又一次具体尝试,加入了 LLM 驱动的回合式反应机制。
「多模态」频道最新
- MacPaw 发布 GenRA:多模态 LLM 驱动 3D 模型骨骼动画 — ducha_aiki · 2026-09-08
- ECCV 2026 多模态统一理解生成 workshop 议程与论文盘点 — mohitban47 · 2026-09-08
- Krea 2 图生角色三视图工作流:一张照片转完整 Character Sheet — solomars3 · 2026-09-08
- Seedance 2.5 天际线狂飙视频完整提示词公开 — techhalla · 2026-09-08
- ECCV 2026 AI4VA 工作坊收录 14 篇论文,Björn Ommer 等将作主题演讲 — ducha_aiki · 2026-09-08
- 本地 MiniMax H3 生成 29 段动作视频,搭出可对话的 AiTuber 立绘 — Hailuo_AI · 2026-09-08