Jerry Tworek 谈 AI 评估时代终结:Codex、RL 与自动化研究实验室
agihouse_org · x · 2026-07-23
在 AGI House 的访谈中,前 OpenAI 研究副总裁 Jerry Tworek 分享了对 AI 评估、代码模型、强化学习等领域的深刻见解。他认为“评估的时代已经结束”,并讨论了 Codex、HumanEval、GitHub Copilot 的经验教训、RL 如何塑造推理行为、工具使用中系统与算法的关系、测试时计算是否还有扩展空间,以及构建自动化 AI 研究实验室的挑战。
所属事件:前OpenAI高管Jerry Tworek称AI评测时代已终结(2 条相关)→
「漫话AGI」频道最新
- Anthropic 内部爆料:并非人人都持高 p(doom) 灾难论 — anpaure · 2026-09-11
- 一万个智能体能否突破反向传播,找到更好的学习算法 — SeunghyunSEO7 · 2026-09-11
- AI 陪伴的隐秘代价:它消解了建立真实亲密关系所需的摩擦 — YogeshMalik · 2026-09-11
- Wired 深度解析:为何众多 AI 研究者担心机器威胁人类生存 — wiredmagazine · 2026-09-11
- 「幻觉」或是范畴错误:把 AI 叫智能正在限制我们的想象 — Genaforvena · 2026-09-11
- 观点:Agent 真正的瓶颈是企业数据工程能力 — dhruv2038 · 2026-09-11