字节高管分享AGI路径:强化RL不如押注数据与环境

shuchaobi · x · 2026-08-08

字节跳动大模型团队负责人吴永辉回顾了自己14个月前的演讲,认为其中关于 AGI 的预测依然成立。他指出,强化学习(RL)本质是寻求局部最优的模式,泛化能力有限,AI真正的泛化能力来源于数据和环境的构建。

目前其团队正致力于两个核心方向:

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →