Reddit 用户质疑:DeepSeek 4.1 Flash 与 Qwen3-Coder 的火爆名不副实?

soft_troll · reddit · 2026-10-06

发帖者通过 DeepInfra 实测 DeepSeek 4.1 Flash 和 Qwen3-Coder 48B Turbo 后表示不解:这两个模型虽然极便宜,但在稍复杂的任务上耗时极长、常找不到真正的 bug,只适合脚手架和样板代码,连 React 项目都会「自信地改错」。与 Claude Opus 5.5 相比毫无竞争力。他猜测这类模型的炒作主要在于每美元生成的代码量,而非真正的推理与调试能力,并向社区求证是否遗漏了什么。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →