清华与腾讯混元 RoboDawn:冻结 VLM 指令驱动机器人达 73.6% 成功率
_akhaliq · x · 2026-09-22
清华大学与腾讯混元团队发布 RoboDawn 研究,探索把视觉语言模型(VLM)的智能迁移到机器人控制:
- 冻结的 VLM 通过简单的移动、旋转、夹爪指令即可驱动机器人,无需微调模型本身。
- 在 RoboTwin 2.0 C2R 基准上取得 73.6% 的 one-shot 成功率。
「具身」频道最新
- IROS 2026 落地匹兹堡:4000 人参会、近 2000 篇论文 — heatherknight · 2026-09-23
- Jim Fan 力挺视频训练机器人:称 VR 遥操作「不具可扩展性」 — dawnsongtweets · 2026-09-23
- 开发者用 Copilot CLI 给 AI Agent 造出 ESP32 桌面表情伴侣 — DanWahlin · 2026-09-23
- seeMote Cube 发布:Vision Pro 首个红外 6DoF 空间配件 — OwariDa · 2026-09-22
- 在 Isaac Sim 里估算 Unitree G1 关节发热:热损失可视化 — IsaiahBallah · 2026-09-22
- PragmaBot 让机器人从失败中在线学习:反思存入记忆、检索复用 — ChongZzZhang · 2026-09-22