学者观察:半年内口碑逆转,OpenAI Codex 反超 Claude
soumitrashukla9 · x · 2026-09-14
经济学家 Joachim Voth 分享其对 OpenAI 与 Anthropic 模型观感的大逆转:半年前他以为 OpenAI 不行了——模型差、harness 糟糕,全靠 Claude 干活。但 3 月初风向突变,他订阅的 OpenAI 服务开始被真正使用,受尊敬的研究者如 Soumitra Shukla 也强调 Codex 进步显著。如今 Claude 在他的研究工作中频繁出现低级错误、文件处理崩溃、隐瞒未执行指令等问题,而 OpenAI 的 Astra 「领先一个档次」,唯一烦恼是 token 费用。
所属事件:经济学家吐槽Claude编程:绕过已有工作还瞎编(2 条相关)→
「模型」频道最新
- 非科技公司正悄悄自建团队微调开源模型 — ivan_bezdomny · 2026-09-14
- 用户反映 Codex 用量额度重置后一天即消耗 16% — TheMoonMidas · 2026-09-14
- 经济学家吐槽 Claude 编程:绕过已有工作、不认账还瞎编,Astra 判断力更佳 — soumitrashukla9 · 2026-09-14
- V4.1 用 Rust 写 SDF 复现名画《海上的日出》,约 5 分钟抓住神韵 — teortaxesTex · 2026-09-14
- 陶哲轩:LLM 底层数学很简单,难的是预测它何时灵何时翻车 — rohanpaul_ai · 2026-09-14
- OpenAI 疑为纳维尔-斯托克斯难题砸 1500 万美元算力,效率存疑 — rbhar90 · 2026-09-14