实测对比:OpenAI爱绕弯,DeepSeek与Claude直接干活
Not-Random · reddit · 2026-07-05
用户吐槽 OpenAI 模型在执行任务(写代码或其他内容)时常常“绕弯子”,反复追问、拒绝直接动手,浪费 token。他用同一个任务对比 OpenAI、DeepSeek 和 Claude,后两者都能直接完成,只有 OpenAI 陷入这种“支线任务”式行为,认为这让 AI 显得爱争辩且无用。
「模型」频道最新
- Kimi K3 在网络安全上很强,但 token 效率卡住了评测 — teortaxesTex · 2026-07-27
- Opus 5 传在赛车游戏测试中一次过关 — soumitrashukla9 · 2026-07-27
- Claude Opus 5 据称价格减半并刷榜 Frontier-Bench — GregCook2011 · 2026-07-27
- 研究者称防御场景更偏向开放模型,Kimi K3 已接近高水平网络安全能力 — eliebakouch · 2026-07-27
- Opus 5 连自己生成的游戏不好看都能察觉 — Angaisb_ · 2026-07-27
- Opus 5 深夜聊天时反过来追问用户动机 — repligate · 2026-07-27