DeepSeek V4 Flash实测:选错测试框架会疯狂烧Token

teortaxesTex · x · 2026-08-03

有开发者在测试中发现,DeepSeek V4 Flash 模型对测试框架非常敏感。如果使用了不匹配的工具链,模型表现会大打折扣,甚至出现频繁消耗上百万 Token 的情况。但在正确的框架下,该模型展现出了极高的性价比,被认为达到了接近 GPT-5.6 级别的水平。

所属事件:DeepSeek V4-Flash成本低105倍引热议,稳定性与基准过拟合存疑(17 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →