实测 DeepSeek-V4-Flash 推理模式:Low 反而比 High 更冗长
coder543 · reddit · 2026-08-03
Reddit 用户对 DeepSeek-V4-Flash-0731 的四种推理强度模式(无、Low、High、Max)进行了测试,发现了一个反直觉的现象:Low 模式生成的 token 数量竟然高于 High 模式。
作者分别在本地量化版本和 DeepSeek 官方 API 上进行了验证(每组 20 次请求取平均值):
- Low 模式:平均生成约 1200-1300 tokens,其中推理过程就占了 800-900 tokens。
- High 模式:平均仅生成 500-600 tokens,推理和最终回答都更简短。
- Max 模式:本地运行时最为冗长,但在 API 上表现相对收敛。
作者指出,目前 DeepSeek 和 Artificial Analysis 等平台通常只公布 Max 模式的基准测试成绩,建议未来能提供所有推理模式的评测数据。此外,OpenRouter 目前存在破坏推理模式切换的 Bug,使用时需注意。
「模型」频道最新
- 今日AI圈速览:DeepSeek周末半价、GPT-5.6 Sol降价、阿里配售800亿投AI — APPSO · 2026-08-24
- 隐身模型 Ox Alpha 登场 Context Arena,匹配 GPT-5.6 — scaling01 · 2026-08-24
- Fable 5 仅占 6% 销量,Anthropic 遭遇降本冲击 — rohanpaul_ai · 2026-08-24
- Opus 5 说话像法庭剧?如何调教掉废话 — thk_ · 2026-08-24
- 2026 年中国模型全景:DeepSeek V4、Kimi K3 等在列 — TheTuringPost · 2026-08-24
- 传闻 Claude Opus 6 泄露:上下文 250 万,推理更强 — iamaliveix · 2026-08-24