机器人任务实测:GPT-6 推理越强操作越好,成本差 30 倍

YuXiang_IRVL · x · 2026-09-23

YuXiang(UT Austin 机器人实验室)在 LIBERO 操作任务上发现明确的能力梯度:GPT-6 Astra > GPT-6 Sol > GPT-6 Luna,推理能力越强机械臂操作成功率越高,说明机器人进展不仅需要世界模型、视频生成和机器人数据,也需要更强的推理与多模态模型。

成本差异同样显著:GPT-6 Luna 完不成任务但便宜,62 次 API 调用仅 $0.23(约 $0.0037/次);GPT-6 Astra 用 29 次调用完成,花费约 $3.20(约 $0.11/次),相差约 30 倍。

所属事件:LIBERO 实测显示 GPT-6 推理越强机器人操作越好(2 条相关)→

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →