Claude Code 与 Codex 打败人类纪录,但没人发明新优化器
AI Engineer · youtube · 2026-09-27
Prime Intellect 研究工程师 Elie Bakouch(SmolLM 作者)在 AI Engineer 频道访谈中,让 Claude Code 和 Codex 挑战社区的 Optimizer Speedrun——用最少步数训练出 GPT-2 级别模型。结果两个 agent 都打破了人类纪录。
行为差异显著:Claude Code 每隔九到十小时就停下来说纪录无法打破,约三分之一时间处于空闲;Codex 从不放弃,写更多笔记、派生更多子 agent、烧掉更多 token。在长达六天的运行中,Kimi 是 token 效率最高的;一篇只有 Claude 找到的论文带来了最好成绩。
Bakouch 的核心结论很冷静:没有任何模型发明出新的优化器,它们只是组合已有想法换来小幅提升。他最后介绍了 Prime Intellect 正在构建的 AlphaEvolve 式发现循环,并主张这类递归自我改进研究应在开放环境中进行。
「编程与Agent」频道最新
- Opus 5.5 几分钟写出动画视频,动态设计师该慌还是上车? — daniel_mac8 · 2026-09-27
- 开发者用 Opus 5.5 给自己的已上线网页游戏做预告片 — hullabaloo22 · 2026-09-27
- Grok Build v1.0.41 发布:子代理继承配置与长推理改进 — mark_k · 2026-09-27
- LangChain 创始人 Harrison Chase 谈前沿 harness 构建四要点 — VeryWellVersed · 2026-09-27
- 开发者开源 Grok Bot「幕僚长」模板:后台专家智能体群只报关键决策 — RachelVT42 · 2026-09-27
- Meta 推手部优先开发方案:Unity 与 Meta SDK 一套代码多端适配 — Scobleizer · 2026-09-27