DeepSeek 跑分依赖极限推理模式,实际耗时暴增近十倍
TheZachMueller · x · 2026-08-01
社区成员指出,DeepSeek 近期公布的基准测试高分实际上全部依赖于开启最大推理强度模式。
在该模式下,模型会消耗约 2 到 10 倍的输出 Token,同时草稿接受率会略微降低。综合下来,完成相同任务的实际物理耗时(wall time)会暴增至常规状态下的 5 到 10 倍。例如,原本只需 5 分钟的任务,在极限推理模式下可能需要运行 25 到 50 分钟。这解释了为何用户在实际使用中可能会感觉模型响应缓慢。
「模型」频道最新
- 今日AI圈速览:DeepSeek周末半价、GPT-5.6 Sol降价、阿里配售800亿投AI — APPSO · 2026-08-24
- 隐身模型 Ox Alpha 登场 Context Arena,匹配 GPT-5.6 — scaling01 · 2026-08-24
- Fable 5 仅占 6% 销量,Anthropic 遭遇降本冲击 — rohanpaul_ai · 2026-08-24
- Opus 5 说话像法庭剧?如何调教掉废话 — thk_ · 2026-08-24
- 2026 年中国模型全景:DeepSeek V4、Kimi K3 等在列 — TheTuringPost · 2026-08-24
- 传闻 Claude Opus 6 泄露:上下文 250 万,推理更强 — iamaliveix · 2026-08-24