首个推理努力参数直接影响长度惩罚的模型?V4.1 设计引关注
nrehiew_ · x · 2026-09-11
nrehiew 指出 V4.1 是他见过的第一个拥有「数值化 reasoning effort 参数」的模型,该参数直接影响长度惩罚——即用户可以用数值直接调节模型推理长度/深度与输出简洁度之间的权衡。
所属事件:DeepSeek V4.1 技术报告解读:RL 基建、沙箱与推理栈细节曝光(8 条相关)→
「模型」频道最新
- ApprenticeBench 揭真实工作差距:闭源 72% vs 开源 Kimi K3 仅 18% — ysu_nlp · 2026-09-11
- CursorBench 4.0 上线:Muse Spark 1.3 性能追平 Sol,价格不到四成 — jyangballin · 2026-09-11
- 稀疏注意力可做多层级:DeepSeek V3.2 思路与搜索排序系统同构 — nptacek · 2026-09-11
- muse spark 1.3 在 CursorBench 4 上表现强且便宜 — infoxiao · 2026-09-11
- 用户盼 Haiku 3.5 回归:旧模型可被永久切断引不满 — repligate · 2026-09-11
- kalomaze:fable 5 部分问题出在后训练没做熟 — kalomaze · 2026-09-11