预测不等于感知:视频模型做具身智能还差得远
PierceLilholt · x · 2026-07-30
Pierce Lilholt 指出,在 AI 应用中「预测」与「感知」是两个截然不同的概念,这一区别的重要性将远超人们目前的认知。
在引用的讨论中,@taiyasaki 进一步补充指出,如果仅仅依赖通用的视频生成模型作为具身智能的核心感知系统是远远不够的。虽然目前的方案看似可行,但真正落地还需要为其添加更多专门的模块与机制(“铃铛和哨子”)。不过他也认为,随着技术发展,这种感知能力的进步最终会被视为理所当然。
「具身」频道最新
- 1X CEO重申承诺:人形机器人Neo年底交付将支持全自主 — ChrisGPT · 2026-07-30
- 曝 Google Gemini Robotics 即将迎来 2.0 重大更新 — CyberRobooo · 2026-07-30
- 谷歌预告 Pixel 11 Pro 将带来全新 AI 摄影体验 — docmilanfar · 2026-07-30
- 斯坦福等提出 Handroid:可在人形与灵巧手间变形的机器人 — carlosdponx · 2026-07-30
- RATs:多智能体机器人终身技能学习系统,无需梯度或强化学习 — rsasaki0109 · 2026-07-30
- 加州初创公司Satyress推2米高半人马机器人 — seanmcdonaldxyz · 2026-07-30