实测大模型超长上下文:30万 token 后智商骤降
teortaxesTex · x · 2026-08-01
开发者实测发现,某模型在处理超长上下文时,约 30 万 token 或 40 轮对话后会出现明显的“变笨”现象。这并非模型无法处理上下文,而是其在长对话机制下的局部推理能力出现衰减,推测可能是缺乏该机制下的充分训练。
「模型」频道最新
- 前端开发AI模型榜单:Claude系列霸榜,Kimi K3跻身前三 — arena · 2026-08-01
- 研究员点赞中国开源模型:前沿差距正以惊人速度缩小 — Xianbao_QIAN · 2026-08-01
- Bittensor子网声称去中心化训练120B模型,5M上下文待验证 — markjeffrey · 2026-08-01
- OpenAI 新特性将推理转化为预算线,提出认知投资回报率 — krishnan · 2026-08-01
- 曝OpenAI向政策制定者演示未发布模型Astra — CremeSubject7594 · 2026-08-01
- 曝 OpenAI 将推新模型家族 Astra,主打多智能体长期协作 — thesaraharminta · 2026-08-01