KAUST 推出免训练方法 Periscope,让冻结模型读超长文
KAUST 团队发布 Periscope 免训练推理方法,通过将文本的多个 chunk 排成 K×K 网格等方式处理长文档,让冻结的语言模型突破上下文窗口限制完成长文问答。该方法可将 9k 窗口模型等效扩展到 1M 上下文,27B 模型仅需单卡 80GB 显存即可读取约 450 万 token 的超长文本。
2026-10-06 ~ 2026-10-06 · 2 条相关
- Periscope 无需训练读超长文,9k 窗口等效 1M 上下文 — _reachsumit · 2026-10-06
- KAUST 提出免训练 Periscope:27B 模型单卡 80GB 读 4.5M token 长文 — KAUST · 2026-10-06