机器人能精准停手却看不懂全局进度?Gemini评测揭示隐患

Crescitaly · reddit · 2026-08-05

Google 最新的 Gemini Robotics ER 2 评测数据揭示了一个有趣的可靠性问题:该模型在精准定位特定动作完成节点(如倒满咖啡)时准确率高达 91.3%,误差不到 1 秒;但在评估任务整体处于哪个阶段(五分制)时,准确率仅有 57.4%。

这种局部感知与全局认知的脱节,对机器人的错误恢复、人机协作交接以及计费等场景构成了挑战。作者由此抛出了一个值得探讨的架构问题:对于物理智能体而言,任务完成检测是否应该作为一层独立的安全机制,而不是单纯依赖生成式规划器的输出?

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →