实测 DeepSeek-V4-Flash 推理模式:Low 反而比 High 更冗长

coder543 · reddit · 2026-08-03

Reddit 用户对 DeepSeek-V4-Flash-0731 的四种推理强度模式(无、Low、High、Max)进行了测试,发现了一个反直觉的现象:Low 模式生成的 token 数量竟然高于 High 模式。

作者分别在本地量化版本和 DeepSeek 官方 API 上进行了验证(每组 20 次请求取平均值):

作者指出,目前 DeepSeek 和 Artificial Analysis 等平台通常只公布 Max 模式的基准测试成绩,建议未来能提供所有推理模式的评测数据。此外,OpenRouter 目前存在破坏推理模式切换的 Bug,使用时需注意。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →