Codex 用户吞吐翻倍
TheZachMueller · x · 2026-07-20
作者更新说,Codex 在当晚把每用户吞吐提升到了 2 倍。
引用里的上下文是:
- 之前已经跑到 20 tok/s/user。
- 配置是 10GbE,并且采用了节点间 4/2 GPU 切分。
- 这还是在 未做进一步优化、并且已经启用 spec decode 的情况下达到的。
这条的重点不是模型能力本身,而是编码代理系统的吞吐和工程调优进展。
所属事件:Codex 用户吞吐量翻倍且体验可用(2 条相关)→
「编程与Agent」频道最新
- 有人想给软件工程任务建「形态分类」数据库,好按任务选模型 — StewartalsopIII · 2026-09-11
- 用 prompt 造硬件:一次对话让智能体组装定制设备寄到家 — paraschopra · 2026-09-11
- 模型之外才是关键:一文拆解 RAG 到多智能体的六大 AI 架构 — goyalshaliniuk · 2026-09-11
- 零基础开发者自建分层记忆架构,仅 20k token 记住一年对话 — matteoianni · 2026-09-11
- Warp 六个非工程团队全用 Linear 和 Claude Code 工程化运作 — mon__lim · 2026-09-11
- 九年后端老兵:AI 代码不比人写的差,变糟的只是速率 — Sweaty-Landscape-561 · 2026-09-11