开发者质疑 DeepSeek 新版跑分:实测未见优于 GLM 5.2

Sentdex · x · 2026-08-06

开发者 Sentdex 发推表示,尽管有跑分显示 DeepSeek 新版(DSV4F-0731)表现优异,但他个人体验并未感觉其能力等同于或优于 GLM 5.2。他呼吁社区能在统一的独立测试框架下,验证该模型的真实得分是否真的超越了 GLM 5.2。

所属事件:开发者实测超10亿Token质疑DeepSeek新版刷榜(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →