预测不等于感知:视频模型做具身智能还差得远

PierceLilholt · x · 2026-07-30

Pierce Lilholt 指出,在 AI 应用中「预测」与「感知」是两个截然不同的概念,这一区别的重要性将远超人们目前的认知。

在引用的讨论中,@taiyasaki 进一步补充指出,如果仅仅依赖通用的视频生成模型作为具身智能的核心感知系统是远远不够的。虽然目前的方案看似可行,但真正落地还需要为其添加更多专门的模块与机制(“铃铛和哨子”)。不过他也认为,随着技术发展,这种感知能力的进步最终会被视为理所当然。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →