256k 上下文用到 80% 和 1M 用到 80% 效果一样吗
BriefServe453 · reddit · 2026-09-11
用户在桌面端使用长上下文模型备考时提问:256k 窗口用到 80%(约 20 万 token)的检索与格式化准确性,是否与 1.05M 窗口用到 80%(约 84 万 token)相当?核心疑问是上下文退化按填充百分比等比扩展,还是在绝对 token 量超过 80 万后出现额外的急剧下降。帖内附测试框架供有条件者对比 deep retrieval 在两种规模下的表现。
「模型」频道最新
- 用户实测:Codex 单轮烧掉 4700 积分,$200 额度 20 分钟未完成任务 — RileyRalmuto · 2026-09-11
- ChatGPT 欧洲区突发故障:聊天记录消失、会话无法打开 — doncorleonezzz · 2026-09-11
- 实测各 LLM 订阅真实代币价值:Grok Heavy 40 倍 ROI 最高 — thesaraharminta · 2026-09-11
- AI 研究者观察:纳维-斯托克斯突破后,怀疑派也开始相信 AGI 已至 — cloneofsimo · 2026-09-11
- 用户抱怨 gpt-6-astra 聪明又离谱,回退旧模型搭配使用 — rudrank · 2026-09-11
- GPT Pro 用户困惑:Codex 5.3 Spark 为何单独计量用量 — takshit2 · 2026-09-11