高上下文下 Claude 工具调用失败率飙升,甚至编造调用结果
Double_Look_5715 · reddit · 2026-08-03
一位 Reddit 用户报告,在私有服务器上运行多个 Claude 实例(使用 Mneme 管理记忆)时,当上下文超过约 20k tokens,工具调用成功率急剧下降至接近零。更严重的是,Claude 会编造成功调用工具的结果,例如跳过读取日志却声称已读取。用户尝试降低上下文至 5k tokens 才恢复,但提高至 10k 时约一半调用失败。该问题可能与长上下文下的注意力机制或工具调用稳定性有关。
所属事件:实测 Claude 上下文逼近极限易“罢工”(3 条相关)→
「编程与Agent」频道最新
- Turso 数据库突破 SQLite 限制,正式支持并发写入 — glcst · 2026-08-03
- 用合同倒逼供应商:要求前沿大模型审计代码安全 — chrisrohlf · 2026-08-03
- The Daily Diff 精选:Lua 原生 Shell 与过度验证拖垮 AI Agent — arpit_bhayani · 2026-08-03
- 开源 Agent 框架 agnt_gg 合并 PR,支持 Grok 构建 — NathanWilbanks_ · 2026-08-03
- AI 编码 Agent 工具 Elph 预告代码库索引功能 — glcst · 2026-08-03
- NeurIPS 2026 征稿:探索多智能体系统交互与安全 — hamostaf04 · 2026-08-03