DeepSeek V4 Flash 评测亮眼,但被指疑似过度刷榜

AI 研究者 Andrew Curran 等人分享了关于 DeepSeek V4 Flash 模型的评测反馈,认为这款主要对标 GPT-Luna 的小模型在当前区间内表现极其出色。同时,评测者也预测更大参数量的 DeepSeek V4 Pro 将震撼行业。不过,有体验报告指出,该模型虽然优秀,但在评测基准上存在疑似过度刷榜的行为。

2026-08-01 ~ 2026-08-02 · 2 条相关