实测对比:V4-Flash-Vision-Exp 代码改进优于 GLM 5.3

teortaxesTex · x · 2026-09-02

作者将同一个硬核工程问题交由 V4-Flash-Vision-Exp 和 GLM 5.3 进行改进。结果显示,GLM 遇到了订阅限制,冷却期后生成的代码甚至有更多 bug。而 V4-Flash-Vision-Exp 则对原有方案实现了帕累托改进(在至少一个指标上更好且无其他指标变差)。作者据此认为,人们可能高估了“Whale”(通常指代前沿模型或特定顶级模型)与当前其他模型之间的差距。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →