前 OpenAI 核心高管 Jerry Tworek 专访:七年强化学习与 o1 模型内幕
agihouse_org · x · 2026-08-06
前 OpenAI 核心高管 Jerry Tworek 在 AGI House 峰会上发表了主题演讲并接受了长篇专访。文章回顾了他在 OpenAI 七年的强化学习(RL)研究历程,期间他带领团队开发了具备思考能力的 o1、o3 模型以及 GPT-5 的底层推理机制,并曾主导开发初代 GitHub Copilot 背后的 Codex 模型。
Tworek 于今年一月离职,并在四月创立了 Core Automation。在访谈中,他深入探讨了强化学习的扩展法则、o1 模型的研发思路、传统评估方法的局限性,以及 Transformer 架构在学习能力上的边界。
「公司和人」频道最新
- 前 OpenAI 董事 Aschenbrenner 携 4 亿美元重返投资界 — firstadopter · 2026-08-06
- 证据补充:Claude 已大量编写 Anthropic 提交代码 — imjustnewatai · 2026-08-06
- 从招聘洞察 AI 自我进化:模型迭代周期正急剧缩短 — imjustnewatai · 2026-08-06
- Meta 披露多厂遭 AI 黑客攻击,根源直指沙箱配置失误 — altryne · 2026-08-06
- AI对齐专家David Krueger将于Ai4大会探讨AI安全与人类赋权 — DavidSKrueger · 2026-08-06
- Salesforce 高管 Srini 离职,内部人士指公司前景不妙 — darian314 · 2026-08-06