开发者实测超10亿Token质疑DeepSeek新版刷榜
开发者 @Sentdex 在本地使用 DeepSeek 新版模型(DSV4F-0731)处理了超 10 亿 Token 的数据。尽管跑分显示该模型表现优异,但他指出实际体验并未感觉其能力等同或优于 GLM 5.2,由此质疑该模型可能存在刷榜现象,并呼吁社区能在统一标准下进行测试。
2026-08-06 ~ 2026-08-06 · 2 条相关
- 开发者质疑 DeepSeek 新版跑分:实测未见优于 GLM 5.2 — Sentdex · 2026-08-06
- 本地跑超10亿Token实测:开发者质疑DS新模型刷榜 — Sentdex · 2026-08-06