研究发现混合架构 LLM 过度依赖注意力,激发循环记忆问答提升 4.6%

EliasEskin · x · 2026-10-07

一项针对注意力-循环混合架构 LLM(如 Qwen3.5)的研究发现:

结论:混合架构的潜力远未榨干,显式引导循环记忆的使用是低成本涨分方向。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →