曝 DeepSeek-V4.1-Flash 支持 1-100 连续可调推理强度
zainhas · x · 2026-09-10
博主 zainhas 分享了一张截图,称 DeepSeek-V4.1-Flash 支持 1 到 100 的连续可控推理强度(reasoningeffort),并感叹从未在其他模型上见过这种设计。与常见的 low/medium/high 离散档位不同,该模型允许以整数粒度连续调节推理力度。此消息来自第三方分享的截图,尚待官方确认,但若属实将是一种新的推理成本/质量调节范式。
所属事件:传闻 DeepSeek V4.1 曝光:552B 新架构多项跑分刷新(15 条相关)→
「模型」频道最新
- Reddit 用户拆包 safetensors:DeepSeek V4.1 Flash 实为 748B 参数 — DistanceSolar1449 · 2026-09-10
- Kimi K3 上线 RunPod:2.8T 参数、1M 上下文,$3/$15 定价 — Kimi_Moonshot · 2026-09-10
- 一周烧掉3亿 token 仍未触顶,GLM 5.3 额度宽松引热议 — saibharadwaj · 2026-09-10
- 爆料补注:V4 系列或已有 3T 参数模型, Scaling 风险是关键变量 — teortaxesTex · 2026-09-10
- 爆料推算:DeepSeek V4.1 Pro 或为 3.1T 参数 MoE,磁盘占用 2.6TB — teortaxesTex · 2026-09-10
- 新书教程:零基础从零训练微调自己的 GPT 级小模型,附全套 Colab — Roger_M_Taylor · 2026-09-10