深度跃迁发布 DELE-w0.5:弃用视频生成管线做机器人操作模型
jiqizhixin · x · 2026-09-13
深度跃迁(DeepLeap)发布机器人操作模型 DELE-w0.5。其核心论点是:基于视频生成的 world-action model 需要预测手臂运动、物体外观、光照变化等高维视觉内容才能输出低维动作序列,计算量巨大,而机器人操作的目标是预测动作执行后的世界状态,而非复现每一帧画面。DELE-w0.5 彻底放弃视频生成管线,训练时联合学习机器人动作、无需预测未来视觉轨迹,转而学习「目标条件下的行为重组」:当环境偏离训练轨迹时,机器人保持原任务目标并根据新状态调整动作。架构分三步:语言指令与当前观察 → VLM 任务规划 → 动作执行。
「具身」频道最新
- Mecka AI 估值逼近 5 亿美元,机器人训练掀起运动数据争夺战 — emmanuelvivier · 2026-09-13
- 最流畅的机器人演示也失败:平滑度指标测不出任务成败 — Scobleizer · 2026-09-13
- 开源 freecad-mcp 让 Claude Desktop 直接操控 FreeCAD 建模与有限元分析 — tom_doerr · 2026-09-13
- 机器人巡逻与课堂助教:中外机器人落地场景一览 — Scobleizer · 2026-09-13
- 优必选柳州工厂产能迈向万台,U1订单已超1.3万台 — CyberRobooo · 2026-09-13
- 用 Copilot CLI 给 ESP32 硬件做会睡觉的交互角色 — DanWahlin · 2026-09-13