BlockRank:用分块稀疏注意力加速 LLM 文档排序

dejanseo · x · 2026-10-05

dejan.ai 介绍 UT Austin 与 Google 研究者提出的 BlockRank 方法,解决 In-Context Ranking(ICR)的计算瓶颈:LLM 自注意力对输入长度的复杂度为 O(n²),候选文档一多就慢且贵。

所属事件:BlockRank 分块稀疏注意力加速 LLM 文档排序(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →