亚马逊论文:匹配 KV-Cache 策略可防长文崩坏

rohanpaul_ai · x · 2026-08-31

亚马逊新论文指出,KV-cache 策略不仅是推理优化,更应改变模型训练方式。若推理时模型会遗忘上下文,训练时就应模拟这种遗忘。

所属事件:亚马逊论文:训练需匹配推理时 KV 缓存策略(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →