Anthropic J-lens 把像素视频模型变成可玩的世界模型
mathemagic1an · x · 2026-07-29
这条直接抛出问题:视频模型到底是在学物理,还是只是随机的像素鹦鹉?
- 用原始像素训练 Transformer,可能真的会得到一个因果世界模型。
- 甚至可以把这个模型“像游戏一样玩起来”。
- 作者称这是把 Anthropic 的 J-lens 用在视频模型上的结果,并给出了代码和可试玩示例。
所属事件:研究称400万参数视频模型涌现物理世界表征(4 条相关)→
「多模态」频道最新
- AI 短视频把“绑架”拍成了分身梗 — umesh_ai · 2026-07-29
- Claude游戏艺术能力飞跃:一年前后对比令人惊叹 — iamfakhrealam · 2026-07-29
- SDXL图像生成:如何构建复杂的多角色互动视角 — ZeHirMan · 2026-07-29
- Hailuo AI 新视频模型据称可接收 12 组图文音频参考 — aziz4ai · 2026-07-29
- PDD 通过一次预测多步去噪加速图像和视频生成 — ArashVahdat · 2026-07-29
- 一条 AI 周报塞进机器人 MMA、FLUX 3 和艺术之争 — PurzBeats · 2026-07-29