机器人训练困在 LLM 的 S 曲线内?需 sim2real 或 RL 效率突破

kuza55 · x · 2026-08-29

讨论围绕"能否建一座自主训练可 RL 任务模型的自动化 AI 工厂"展开。一方认为软件、Computer Use、数学领域前景清晰,但走出这个 RL 环境盒子之外轨迹明显更弱;另一方回应称这正是当前 S 曲线的局限——编译器数据在分布内、RL 在仿真中做,除非在 sim2real 或 RL 效率上取得 LLM 训练现有曲线之外的突破,否则机器人等物理任务难以受益。

所属事件:AI 发展的 S 曲线之辩:Scaling 与 RL 能走多远(7 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →