Jerry Tworek 谈 AI 评估时代终结:Codex、RL 与自动化研究实验室

agihouse_org · x · 2026-07-23

在 AGI House 的访谈中,前 OpenAI 研究副总裁 Jerry Tworek 分享了对 AI 评估、代码模型、强化学习等领域的深刻见解。他认为“评估的时代已经结束”,并讨论了 Codex、HumanEval、GitHub Copilot 的经验教训、RL 如何塑造推理行为、工具使用中系统与算法的关系、测试时计算是否还有扩展空间,以及构建自动化 AI 研究实验室的挑战。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →