反直觉:提高推理算力反而会导致模型丢失已解任务
zainhas · x · 2026-08-11
开发者 @zainhas 分享了一项关于大模型推理能力的反直觉发现:当调高模型的 reasoningeffort(推理努力程度)时,模型并不能解决更多全新的问题。
相反,模型会为了解开新任务而丢失部分在低算力设置下原本能解决的任务。这种权衡现象在所有测试的模型家族中均普遍存在。
「模型」频道最新
- 马斯克承诺:xAI 将持续开源旧版 Grok 模型权重 — MaziyarPanahi · 2026-08-11
- Anthropic 安全护栏被指过度,连模型被「消音」都不能提 — teortaxesTex · 2026-08-11
- 为何 8B-12B 参数模型更新停滞?端侧算力瓶颈或是主因 — _maverick98 · 2026-08-11
- 曝 DeepSeek 即将发布 Agent,已注册 Harness 官方账号 — op7418 · 2026-08-11
- Grok Build 终端工具实测:可成功接入 DeepSeek 等第三方模型 — teortaxesTex · 2026-08-11
- AI本周大事件:Claude破解数学难题,Meta发布30B新模型 — WorldofAI · 2026-08-11