256k 上下文用到 80% 和 1M 用到 80% 效果一样吗

BriefServe453 · reddit · 2026-09-11

用户在桌面端使用长上下文模型备考时提问:256k 窗口用到 80%(约 20 万 token)的检索与格式化准确性,是否与 1.05M 窗口用到 80%(约 84 万 token)相当?核心疑问是上下文退化按填充百分比等比扩展,还是在绝对 token 量超过 80 万后出现额外的急剧下降。帖内附测试框架供有条件者对比 deep retrieval 在两种规模下的表现。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →