200美元订阅横评:OpenAI 编码效率与纠错能力均超 Anthropic
Sudden_Rip7717 · reddit · 2026-08-08
一位开发者在一周的私人项目中,同时满负荷运行了 OpenAI 和 Anthropic 价值 200 美元的订阅服务(分别使用 Codex/Sol 和 Claude/Fable)进行对比。
额度消耗:到周五重置时,Anthropic 账号已超 60%(Fable 架构师用量超 90%),而 OpenAI 仍有约 23% 余量。日志显示 Codex 处理了约 27 亿 token(多为缓存),是 Claude 线程的 4 倍。
纠错能力:作者通过交叉审查代码发现,Sol 作为审查者能抓出约三分之二的有效错误,反之则只有三分之一。按同等金额计算,OpenAI 的纠错价值是 Anthropic 的 1.6 倍,严重缺陷发现率更是达到 1.91 倍。
「编程与Agent」频道最新
- YC 投资的 Prized:让非程序员用 AI 安全构建内部工具 — Scobleizer · 2026-08-08
- 无需额外训练,持续评估能让 AI 智能体自我进化 — BlackHC · 2026-08-08
- AI 编程智能体测试盲区:Refactron 自动校验代码覆盖率 — Scobleizer · 2026-08-08
- 斯坦福开源课:构建自我改进 AI 智能体的核心在于外部反馈 — solyarisoftware · 2026-08-08
- pi 推出会话间协作插件:支持多智能体互发消息与递归拆解 — solyarisoftware · 2026-08-08
- 构建防幻觉评估体系:如何有效监测大模型生成质量 — goyalshaliniuk · 2026-08-08