曝 DeepSeek-V4.1-Flash 支持 1-100 连续可调推理力度
zainhas · x · 2026-09-10
网友 @zainhas 发现 DeepSeek-V4.1-Flash 的论文(原文附链接)显示,该模型支持从 1 到 100 的连续可调推理力度(reasoning effort),而非业界常见的 low/medium/high 等离散档位。发帖人称此前从未在任何模型上见过这种设计,认为这会带来一些新的复杂性。具体细节需参考其论文,该消息未经官方确认,属可信爆料性质。
所属事件:DeepSeek V4.1 曝 552B 非对称激活架构(15 条相关)→
「模型」频道最新
- Gemini 3.8 Flash 仅 3 轮对话自我纠错完成任务,作者晒演示 — Artistic_Solution117 · 2026-09-10
- 「外星架构」引发热议,博主建议叠加 recurrent depth 技术 — scaling01 · 2026-09-10
- 用户请愿 OpenAI 推 $400–600 重度档:$200 额度 48 小时烧光 — dragonwarrior_1 · 2026-09-10
- 爆料称 SpaceXAI 正把 Grok Bot 接入 XChat,对话中可 @ 机器人提问 — nima_owji · 2026-09-10
- 智谱新模型成绩被质疑:8 种考法报最高分,满思考档才刷出 74.2 — teortaxesTex · 2026-09-10
- 宇树全面开源 6B 人形机器人基础模型 UnifoLM-WLA-1.0 — teortaxesTex · 2026-09-10