开发者实测:DeepSeek 新模型刷榜强,实际体验远不如跑分

Arindam_1729 · x · 2026-09-27

@bindureddy 吐槽 DeepSeek 是「刷 benchmark 之王」,其最新 Flash 模型宣称对标 Fable 和 Astra,但实际用两分钟就知道名不副实。回复者 Arindam 补充:不过他在测试中发现其视觉能力确实不错。

所属事件:开发者吐槽 DeepSeek 新模型刷榜强实际体验差(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →