浙大发布 RoboSPA 基准:考验 VLA 长程任务与细粒度空间推理
zju · hf · 2026-09-09
浙江大学团队在 Hugging Face 发布大规模机器人操作基准 RoboSPA,评估视觉-语言-动作(VLA)模型能否超越简单场景和短时程任务。
- 核心考察两项能力:细粒度空间推理与长时程程序化规划
- 采用难度递进的任务变体设计,逐级加大挑战
- 回应当前 VLA 模型多在简单场景、短任务上表现好、泛化能力存疑的问题
「具身」频道最新
- 往机器人 VLA 模型里加希腊语:双语训练可提升性能但远逊英语 — KIEFERSA · 2026-09-09
- Darpinian 预测:OpenAI 年底前将大举吞下机器人赛道 — Darpinian · 2026-09-09
- ECCV 2026 具身智能专场:世界模型热议,作者抛出「先问动作是什么」 — dimadamen · 2026-09-09
- 软银领投 2 亿美元,Gravis Robotics 给挖掘机装自主层估值破 10 亿 — lukas_m_ziegler · 2026-09-09
- 苹果秋季发布会前瞻:折叠iPhone Duo与未来三年最大新品计划 — APPSO · 2026-09-09
- 比亚迪闪充 -30℃ 下 12 分钟充至 97%,全国已建超万座闪充站 — chrisfirst · 2026-09-09