DeepMind EXIMO 展示机器人模型「吃掉脚手架」的迭代循环
m_wulfmeier · x · 2026-09-07
Google DeepMind 研究员 mwulfmeier 点评 EXIMO 项目(Bhavy 的学生研究项目),指出物理 AI 模型代际之间「创造脚手架再吃掉脚手架」的张力:
- EXIMO 的核心做法是用 Gemini(视觉语言模型)包裹 Gemini Robotics(VLA 模型),形成 VLM 包 VLA 的层级控制,人类可读、便于快速迭代
- 关键一步:项目把这个编排好的行为通过简单模仿学习「蒸」进 VLA 本身的权重里,脚手架消失后即可对整个模型做 RL 优化,超越手工脚手架的能力上限
- 这种「harness → 蒸进模型 → RL 再优化 → 设计下一代 harness」的循环被认为是物理 AI 模型代际演进的一般模式
「具身」频道最新
- 宇树 UnifoLM-X2-1.0 让人形机器人首次全自主实时对战 — Distinct-Question-16 · 2026-09-07
- World Labs 发布世界模型 Atlas:文图视频 3D 原生融合,可输出 1440p 视频和显式 3D — thione · 2026-09-07
- Waymo 正式扩展至伯克利,物理 AI 创业潮在湾区加速 — jfiance · 2026-09-07
- AI 智能体穿线布缆重塑 PCB,人类只需反复说「弄到傻瓜都会」 — yacineMTB · 2026-09-07
- 真机器人演短剧第 3 集:Microduck 献上奥斯卡级表演 — huggingface · 2026-09-07
- $149 桌面设备 Harness:一个硬件调度 Claude Code 等所有编码 Agent — dee_hw · 2026-09-07