斯坦福 Real-Time EXPO-FT:让 VLA 机器人实时追上物理世界
StanfordAILab · x · 2026-09-24
斯坦福 Perry Dong、Chelsea Finn 等人发布 Real-Time EXPO-FT,一个针对实时 VLA(视觉-语言-动作)策略的强化学习微调框架,解决预训练大模型推理延迟导致机器人「看到的世界已过时」的分布偏移问题。方法分三步:大型 VLA 基座慢速生成候选动作块;小型编辑策略基于执行时刻的观测实时修改动作;再用 Q 函数在线选最优候选。该框架让 π0.5 能完成托球平衡、射门等动态任务,定量与实机表现全面显著超过 RTC 基线。论文、代码与实测视频已公开。
所属事件:斯坦福 Real-Time EXPO-FT 让 VLA 机器人实时操控(2 条相关)→
「具身」频道最新
- Scoble 力挺 Meta VR 眼镜:FOV 约为初代 HoloLens 两倍,OLED 显示惊艳 — Scobleizer · 2026-09-24
- 两指夹爪 600 美元,五指灵巧手 2 万美元,机械手价差有多大 — ChongZzZhang · 2026-09-24
- CoRL 2026 论文 TANGO:纯仿真训练人形机器人全身导航,真机零样本迁移 — chris_j_paxton · 2026-09-24
- 马斯克晒首批自产镍正极 Cybercab,美洲首座正极厂落地得州 — elonmusk · 2026-09-24
- Muse 发布钥匙扣形态 AI 设备 muse charm,12 月发货赶上节日季 — alexandr_wang · 2026-09-24
- Meta 新智能眼镜将内置 FDA 认证的助听器功能 — Polymarket · 2026-09-24