机器人学习出现少样本泛化
tonyzzhao · x · 2026-07-17
转发内容强调“机器人时代正在到来”,并引用了一条关于机器人学习的观察:通过**扩大预训练**、再用**少量内部数据做 hill-climb 微调**,可以得到一个通用配方。 引用还给出一个更具体的结果:**第一次出现了“一个微调样本就能教会新行为,并且能泛化”**。示例是折叠任务——模型仅用每种折叠策略一个样本学习,然后在未见过的设置上测试,也能学到 **4 种折叠策略**。
「具身」频道最新
- 中年危机下的AI自救:双3090+Qwen3.6-27b让生产力提升5倍 — Civil_Fee_7862 · 2026-07-21
- WAIC 上的人形机器人演示被形容“有点吓人” — minchoi · 2026-07-21
- 一位创作者称自己登上 NBC《Today》聊机器人对战 — chris_j_paxton · 2026-07-21
- WAIC 具身智能最落地信号:服务器工厂万台部署 — 量子位 · 2026-07-21
- 阿里 RynnBrain 1.1 把具身基础模型扩到 122B-A10B — Alibaba-DAMO-Academy · 2026-07-21
- OpenLongTail 用生成视角补齐长尾自动驾驶数据 — TexasAMUniversity · 2026-07-21