微软 When2Think:AIME24 Pass@3 提升 10%,token 用量省 27.9%

microsoft · hf · 2026-09-18

微软提出 When2Think,一个针对混合推理模型的后训练框架,解决大推理模型「简单题想太多、难题想不够」的系统性低效。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →