LIBERO 实测显示 GPT-6 推理越强机器人操作越好

UT Austin 机器人实验室的 YuXiang Xu 在 LIBERO 机器人操作基准上实测 GPT-6 各版本,发现明确能力梯度:GPT-6 Astra > GPT-6 Sol > GPT-6 Luna,推理能力更强的版本在机器人操作任务上表现更好,且不同版本间成本相差可达 30 倍,说明推理能力与机器人操控水平直接相关。

2026-09-23 ~ 2026-09-23 · 2 条相关