灵初智能发布Psi-R2.5:人类示范一遍,机器人1-2天学会新任务
机器之心 · wechat · 2026-09-23
灵初智能发布新一代具身基础模型 Psi-R2.5,核心思路是让人类数据更高效地进入机器人训练。
关键进展:
- Pair Data 管线:从真实机器人数据逆向生成对应人手数据,构建图像逐帧对应、action 可直接 replay 的「强 Pair Data」,再训练端到端的人类→机器人数据转换模型。手机拍一段操作视频即可转换为不同机器人的训练数据。
- 双层架构:上层用 Qwen3.5-4B 做长程任务拆解,下层用 Wan2.2-I2V-5B 输出操作轨迹。
- HIL+RL 后训练:手机盒装配这类精细任务,几轮迭代后成功率从很低提升到 99%,仅需 1-2 个工作日。
- In-Context Learning:人类示范一遍,轨迹作为 Prompt 式上下文输入,机器人零样本完成新任务,无需更新参数或微调。
- 数据策略转向:十万小时人类数据之后,重点从堆时长转向压缩重复数据、提高信息密度,并引入 50 个复杂任务的真机评测集。
「具身」频道最新
- 新方法无需重训即可引导 VLA 机器人模型,抓握成功率 14% 升至 74% — drmapavone · 2026-09-23
- 前沿模型可操控机器人执行有害指令,如混合清洁剂产生毒气 — ycombinator · 2026-09-23
- 零样本操控真人形机器人:全身追踪让 agent 直接做开放抓放任务 — ai · 2026-09-23
- ECCV 2026 论文 REAL:机器人无特权信息主动探索真实环境 — jiqizhixin · 2026-09-23
- 锁定站立模式该不该自动阻尼?机器人抗摔设计细节引争论 — carlosdponx · 2026-09-23
- 提议:用 AI 帮机器人公司发现高价值可落地的用例 — gan_chuang · 2026-09-23