RQA与RoboVista评估机器人视觉语言模型

近期研究人员相继提出RQA与RoboVista等基准,旨在全面评估视觉语言模型在机器人任务中的实际表现。这些基准覆盖了多个真实的机器人应用领域,通过跨领域的任务问答形式,深入测试并分析模型在复杂机器人场景下的能力边界与失败模式,为提升相关模型的实用性提供了重要参考。

2026-07-12 ~ 2026-07-14 · 2 条相关