机器人学会假设与验证:GPT-4.1 驱动实体试验成功率达 93%

imjustnewatai · x · 2026-07-25

一项新研究展示了机器人在未知环境中的“科学推理”能力。当面对不完整的房屋地图时,机器人能将 LLM 的猜测转化为可测试的假设,主动规划验证步骤并收集现实证据来更新世界模型。

在一次任务中,机器人猜测零度饮料在冰箱,但检查后发现错误,随后自主搜索厨房岛台并找到了正确物品。实验数据表明,这种具备不确定性感知的循环,配合 GPT-4.1 与形式化规划器,在真实家庭试验中达到了 93% 的成功率;而如果不使用该循环,成功率仅为 0% 至 27%。这预示着未来的家用机器人无需完美预编程,即可通过自主实验适应陌生环境。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →