开发者吐槽:当前大模型的长上下文多是缓存与哈希的工程把戏
tokenbender · x · 2026-08-11
一位开发者在推文中尖锐批评了当前大模型的长上下文处理能力。他认为,目前厂商宣传的“长上下文”并非真正的原生长文本理解,而是依赖哈希、索引、学习策略以及多级缓存交换等工程手段拼凑出来的“伪长上下文”。这种实现方式在实际应用中带来了许多痛点,让开发者感到困扰。
「模型」频道最新
- Grok Build 终端工具实测:可成功接入 DeepSeek 等第三方模型 — teortaxesTex · 2026-08-11
- OpenAI 频繁重置额度引争议:被指掩盖 Sol 模型定价失误 — eyishazyer · 2026-08-11
- 两周真实重构实测:Claude 擅长多文件,ChatGPT 适合单次快攻 — Creative_Ostrich890 · 2026-08-11
- DeepSeek 新模型本地实测:日常办公已无需依赖云端 — yacineMTB · 2026-08-11
- 网友高级嘲讽:Anthropic文本水印根本检测不到 — burkov · 2026-08-11
- 智谱 GLM 编程额度将重置,开源大佬暗示 MiniMax 新动向 — Xianbao_QIAN · 2026-08-11