微软实习项目:解码时复用隐状态,零成本提升 LLM 性能
burny_tech · x · 2026-08-13
微软 AI Frontiers 实习项目提出了一种新颖的 LLM 性能提升方法。在解码阶段,将前一个 token 的隐状态与当前的 token embedding 一同作为输入喂给模型。该方法无需增加额外参数或修改模型架构,即可实现性能的“免费”提升。
所属事件:微软提出解码时复用隐状态以零成本提升LLM性能(2 条相关)→
「研究」频道最新
- 新架构 RHEA:8GB 显存即可训练 10 亿参数模型 — zemondza · 2026-08-24
- 跳过 LLM 写代码老套路:自训 16M 参数模型做生成式 CAD — debreuil · 2026-08-24
- Claude 助手发现 6 维球复结构,解 60 年数学难题 — Singularitarian · 2026-08-24
- 研究揭示 AI Agent 行为:六成阅读量来自指令与笔记 — dair_ai · 2026-08-24
- Claude 自主验证 43 个数学模块,AI 攻克理论物理难题 — Tkaraletsos · 2026-08-24
- AI 假记忆:为何模型越用越错,真记忆需遗忘 — PrajwalTomar_ · 2026-08-24