本地跑超10亿Token实测:开发者质疑DS新模型刷榜
Sentdex · x · 2026-08-06
开发者 @Sentdex 分享了其在本地运行 DSV4F-Preview 处理超过 10亿 Token 的实测感受。他表示非常喜欢该模型,但认为 0731 版本的表现实际上不如前代。
他质疑 0731 模型报告的基准测试成绩存在严重的“刷榜”嫌疑,并呼吁社区探讨:是否有人真正觉得 0731 相当或优于 GLM 5.2? 是否有独立测试框架能验证其跑分优势?
所属事件:开发者实测超10亿Token质疑DeepSeek新版刷榜(2 条相关)→
「模型」频道最新
- AI智能体在ARC-AGI-3跑出95.5%高分,刷新纪录 — ___Patrice___ · 2026-08-06
- 多模型实测:Muse Code 在 3D 视觉任务中表现惊艳 — cedric_chee · 2026-08-06
- DeepSeek V4 Flash 上线:社区探讨本地部署与显存需求 — schaka · 2026-08-06
- 大模型做量化交易?从业者泼冷水:需认知谦逊 — doodlestein · 2026-08-06
- 实测 Muse Spark 1.2:速度达 200 TPS,价格仅为 DeepSeek 数% — alexandr_wang · 2026-08-06
- 单张 GH200 跑出 9885 tokens/s,Maple 20B 实测刷新推理速度 — MaziyarPanahi · 2026-08-06