提示与技巧:会话过长会导致 Token 浪费与模型能力下降
hudsonhateno · reddit · 2026-09-02
Reddit 用户解释了长时间运行 LLM 会话的两个主要问题:Token 消耗随上下文处理线性增长,以及模型在上下文占用超过 40% 后输出质量会显著下降。帖文列出了 Codex 平台各模型的上下文窗口和最大输出限制,并建议在会话达到 40%-50% 容量时进行“移交”,即编译当前摘要并开启新会话以释放上下文空间。作者还分享了自创的两个 Skill 工具:$context-capacity 用于计算当前上下文负载和累计用量,$handoff 用于辅助完成会话移交。
「编程与Agent」频道最新
- Rippling 推出 AI 智能体自动解决 IT 繁琐问题 — andreisavu · 2026-09-02
- Fable 5.1 发布:解决智能体编码任务成本降低一半 — airesearch12 · 2026-09-02
- Lovable 解构模型路由策略:不做选择器做驾驭者 — tylerbruno05 · 2026-09-02
- 后端开发新共识:使用 Effect 而非纯 TS — mattpocockuk · 2026-09-02
- 创业者分享 Grok Bot 实战:自动操作电脑、测试应用,一晚搭建完整工作流 — PrajwalTomar_ · 2026-09-02
- 纸上编程能倒逼你专注细节,而非依赖补全 — TivadarDanka · 2026-09-02