DeepSeek v4 Flash 思考模式在 API 中会忽略采样参数
OkDimension2228 · reddit · 2026-07-29
作者排查一个 coding agent 的变量漂移问题时发现,DeepSeek v4 Flash 的 thinking mode 会悄悄忽略采样参数。
- 在官方 API 路径里,temperature、topp、presencepenalty、frequencypenalty 改来改去都没效果。
- 同样的提示词和参数放到自托管的 vLLM 上却正常生效,说明问题出在中间那层,而不是参数本身。
- 读文档后才发现:thinking mode 不支持 这些采样设置,传了也不会报错,只是直接无视;而且 thinking 默认开启。
- reasoningeffort 也不是原样生效:low/medium 会被重映射成 high,xhigh 会变成 max。官方建议是 temperature=1.0、topp=1.0。
作者最后说,变量漂移还没修好,但至少终于知道问题不是从采样参数里来的了。
「模型」频道最新
- 谷歌 AI 讲幻觉概念时,顺手把 Anthropic 点名了 — conitzer · 2026-07-29
- Kimi K3 以单图生成 3D 世界对决 Claude Opus 5 — Prompt Engineering · 2026-07-29
- 用户反馈 Grok 4.5 网页和 Android 端数学排版失效 — flyme2mars · 2026-07-29
- OpenAI 通过 API 发布 GPT Transcribe 和 GPT Live Transcribe — The Decoder · 2026-07-29
- Two Minute Papers 说 Kimi K3 表现夸张,还附论文和试用入口 — Two Minute Papers · 2026-07-29
- 泄露称 Z.ai GLM-5.5 目标对标 Fable 5 和 Mythos — Informal-Trouble2183 · 2026-07-29