优化流程找到“免费暂停词”,让 Transformer 近乎零成本提升推理质量
JohnCLangford · x · 2026-09-08
John Langford 团队(含 @nthngdy、Yoav Artzi 等)将 State Prediction Separation 方法经过自动优化流程改进,发现其可在更高操作点运行,得到所谓“免费暂停词”(free pause tokens),使 Transformer 能以接近零的额外成本做出更高质量的推理。
训练时间开销从 SPS 原来的约 700% 降至摊销后 10-20%(视具体选择而定),作者认为这是对基础 Transformer 的一项可能被广泛使用的改进。
所属事件:微软团队发现「免费暂停 token」近乎零成本提升 Transformer 推理质量(2 条相关)→
「研究」频道最新
- 人类基因组 90 亿 SNP 变异预计算数据集达 1PB,超 AFDB 三十倍 — anshulkundaje · 2026-09-08
- 微软 AI 布道者发文:LLM 本质只是猜下一个词,一切 agent 都是其封装 — sethjuarez · 2026-09-08
- FlowBalance:基于验证器的自改进方法,数学推理较 GRPO 平均提升 2.12 分 — _akhaliq · 2026-09-08
- 机器人先驱 Rodney Brooks 公开 AI 历史文献合集:从图灵到 Minsky — SoloGen · 2026-09-08
- INT21 用 Agent 集群生成 Qwen3.8 训练器,吞吐超 PyTorch 11.5 倍 — bingxu_ · 2026-09-08
- 16-128 并发用户实测:分类与生成任务对 LLM 压力差异显著 — rseroter · 2026-09-08