字节高管分享AGI路径:强化RL不如押注数据与环境
shuchaobi · x · 2026-08-08
字节跳动大模型团队负责人吴永辉回顾了自己14个月前的演讲,认为其中关于 AGI 的预测依然成立。他指出,强化学习(RL)本质是寻求局部最优的模式,泛化能力有限,AI真正的泛化能力来源于数据和环境的构建。
目前其团队正致力于两个核心方向:
- Genius Kid(天才儿童):专注于培养能拿下奥赛金牌的纯粹推理与高智商模型,该阶段已取得成果,正转向旨在成倍扩大理论科学家数量的“X教授”阶段。
- Omnipotent Assistant(全能助手):利用智能在数字世界中执行实际任务,核心挑战在于构建和数字化环境。
「漫话AGI」频道最新
- AI实验室难共享安全研究,长任务奖励黑客成发布阻碍 — willccbb · 2026-08-08
- 扎克伯格复盘击败巨头法则:大公司迟缓缺信念,AI 正重演 Facebook 式颠覆 — r0ck3t23 · 2026-08-08
- Pedro Domingos:企业 AI 实验室的研究自由从来无法长久 — pmddomingos · 2026-08-08
- AI 推理成本终将下降?竞争与算力红利将打破补贴依赖 — intellectronica · 2026-08-08
- 苹果1987年概念视频预言成真:AI让计算回归自然 — LukeW · 2026-08-08
- 模型被训练成会协作,安全威胁被夸大? — dbreunig · 2026-08-08