曝 DeepSeek-V4.1-Flash 支持 1-100 连续可调推理力度

zainhas · x · 2026-09-10

网友 @zainhas 发现 DeepSeek-V4.1-Flash 的论文(原文附链接)显示,该模型支持从 1 到 100 的连续可调推理力度(reasoning effort),而非业界常见的 low/medium/high 等离散档位。发帖人称此前从未在任何模型上见过这种设计,认为这会带来一些新的复杂性。具体细节需参考其论文,该消息未经官方确认,属可信爆料性质。

所属事件:DeepSeek V4.1 曝 552B 非对称激活架构(15 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →