KAUST 推出免训练方法 Periscope,让冻结模型读超长文

KAUST 团队发布 Periscope 免训练推理方法,通过将文本的多个 chunk 排成 K×K 网格等方式处理长文档,让冻结的语言模型突破上下文窗口限制完成长文问答。该方法可将 9k 窗口模型等效扩展到 1M 上下文,27B 模型仅需单卡 80GB 显存即可读取约 450 万 token 的超长文本。

2026-10-06 ~ 2026-10-06 · 2 条相关