机器人任务实测:GPT-6 推理越强操作越好,成本差 30 倍
YuXiang_IRVL · x · 2026-09-23
YuXiang(UT Austin 机器人实验室)在 LIBERO 操作任务上发现明确的能力梯度:GPT-6 Astra > GPT-6 Sol > GPT-6 Luna,推理能力越强机械臂操作成功率越高,说明机器人进展不仅需要世界模型、视频生成和机器人数据,也需要更强的推理与多模态模型。
成本差异同样显著:GPT-6 Luna 完不成任务但便宜,62 次 API 调用仅 $0.23(约 $0.0037/次);GPT-6 Astra 用 29 次调用完成,花费约 $3.20(约 $0.11/次),相差约 30 倍。
所属事件:LIBERO 实测显示 GPT-6 推理越强机器人操作越好(2 条相关)→
「具身」频道最新
- 特斯拉柏林工厂确认:8 月中起员工穿戴设备采集动作,秘密训练 Optimus — CyberRobooo · 2026-09-23
- eidon-ai 发布 tracker-pov 机器人视频数据集,规模 1 万至 10 万条 — eidon-ai · 2026-09-23
- 开发者把 90 年代旧电视改造成 AI 电视:树莓派+摄像头+GPT 实时 API — OpenAIDevs · 2026-09-23
- 新方法无需重训即可引导 VLA 机器人模型,抓握成功率 14% 升至 74% — drmapavone · 2026-09-23
- 前沿模型可操控机器人执行有害指令,如混合清洁剂产生毒气 — ycombinator · 2026-09-23
- 零样本操控真人形机器人:全身追踪让 agent 直接做开放抓放任务 — ai · 2026-09-23