具身智能GPT-3时刻?GEN-1.5演示即执行成功率59%
新智元 · wechat · 2026-08-21
GeneralistAI 发布新一代基础模型 GEN-1.5,被视为具身智能的「GPT-3 时刻」。核心进展如下:
1. Physical Prompting(物理提示)
- 给机器人看 3-12 秒演示,无需训练或微调,机器人即可执行任务。
- 10 个操作任务平均成功率达 59%(One-shot,零梯度步骤)。
- 若提供 5 分钟演示并微调 10 个梯度步骤,成功率提升至 83%。
2. 涌现的即兴能力
- 工具替换:给香蕉代替刷子,能用香蕉扫积木;给簸箕则自动切换策略为“铲起倒入”。
- 环境适应:自发掀开遮挡的碗盖,甚至盖回去;处理粘在手指上的积木。
- 跨平台泛化:在模拟器录制演示,真实机器人可直接执行;支持人类手势演示复现。
3. 技术原理
- 基于大规模物理交互数据预训练(连续 8 个月,未见收敛迹象),验证了具身智能的 Scaling Law。
- 轻度微调(10 步仅改参数 0.15%)保留了更多预训练的“物理经验”,而非重写。
4. 行业影响
- 将新任务适配成本从数月压缩至数秒,降低了机器人使用门槛。
- 宇树科技等硬件厂商面临“大脑缺席”困境,大模型成熟将重塑硬件价值链。
背景:公司获李飞飞、英伟达、小米林斌等投资,估值 20 亿美元。
所属事件:Generalist AI 发布 GEN-1.5:几秒演示即学会物理任务(20 条相关)→
「具身」频道最新
- Text2Sim 用文本生成物理仿真场景,输出可编辑的真物理视频 — erwincoumans · 2026-10-09
- 新加坡 6 英尺机器人格斗翻车,作者指出是遥操作策略选错 — carlosdponx · 2026-10-09
- PredActor 用单一扩散策略统一人形机器人运动生成与控制,G1 端侧跑 50Hz — carlosdponx · 2026-10-09
- Meta 智能眼镜美网广告走红,评论称手机或可留在口袋 — armand_ruiz · 2026-10-09
- 自动驾驶仿真新法:以风险百分位精确控制角落场景有多「角落」 — Jiaxi Liu · 2026-10-09
- 英特尔高管:企业机器人价值大头在存量装机,而非新销售 — ryanshrout · 2026-10-09