递归经验蒸馏让机器人操作成功率从 37.3% 提升至 64.0%

SeoulNatlUniv · hf · 2026-09-29

首尔国立大学提出 Recursive Harness Distillation:强 agent 将干预经验蒸馏成 playbook,再根据轻量 agent 的执行反馈递归精炼,使新任务可复用积累的知识而无需更新模型参数。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →