开发者质疑 DeepSeek 新版跑分:实测未见优于 GLM 5.2
Sentdex · x · 2026-08-06
开发者 Sentdex 发推表示,尽管有跑分显示 DeepSeek 新版(DSV4F-0731)表现优异,但他个人体验并未感觉其能力等同于或优于 GLM 5.2。他呼吁社区能在统一的独立测试框架下,验证该模型的真实得分是否真的超越了 GLM 5.2。
所属事件:开发者实测超10亿Token质疑DeepSeek新版刷榜(2 条相关)→
「模型」频道最新
- Meta 发布 Muse Code 模型测试版 — troll_khan · 2026-08-06
- CoreWeave 上线 DeepSeek V4-Flash-0731 推理服务 — _ScottCondron · 2026-08-06
- Muse Code实测比肩Codex与Claude — alexandr_wang · 2026-08-06
- 用户呼吁API提供商支持K3 logprobs并愿溢价付费 — snwy_me · 2026-08-06
- Meta Muse 1.2 发布:低价策略或重塑竞争格局 — alexandr_wang · 2026-08-06
- MSL 发布 Muse Code:基于 Muse Spark 1.2 的终端编程智能体 — alexandr_wang · 2026-08-06