开发者实测:Claude 跑分更优,Codex 却更懂我要什么

Kuprel · x · 2026-10-07

Anthropic 工程师-related 开发者 Kuprel 回复称,尽管 Claude 在基准测试中表现更好,但实际使用中 OpenAI 的 Codex 更擅长完成他真正想做的事情。

这条体感反馈呼应了社区常见的观点:基准成绩与真实工程任务中的实际可用性并不总是一致。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →