LIBERO 实测显示 GPT-6 推理越强机器人操作越好
UT Austin 机器人实验室的 YuXiang Xu 在 LIBERO 机器人操作基准上实测 GPT-6 各版本,发现明确能力梯度:GPT-6 Astra > GPT-6 Sol > GPT-6 Luna,推理能力更强的版本在机器人操作任务上表现更好,且不同版本间成本相差可达 30 倍,说明推理能力与机器人操控水平直接相关。
2026-09-23 ~ 2026-09-23 · 2 条相关
- 机器人任务实测:GPT-6 推理越强操作越好,成本差 30 倍 — YuXiang_IRVL · 2026-09-23
- LIBERO 实测:GPT-6 各版本推理越强,机器人操作越好 — YuXiang_IRVL · 2026-09-23