提示与技巧:会话过长会导致 Token 浪费与模型能力下降

hudsonhateno · reddit · 2026-09-02

Reddit 用户解释了长时间运行 LLM 会话的两个主要问题:Token 消耗随上下文处理线性增长,以及模型在上下文占用超过 40% 后输出质量会显著下降。帖文列出了 Codex 平台各模型的上下文窗口和最大输出限制,并建议在会话达到 40%-50% 容量时进行“移交”,即编译当前摘要并开启新会话以释放上下文空间。作者还分享了自创的两个 Skill 工具:$context-capacity 用于计算当前上下文负载和累计用量,$handoff 用于辅助完成会话移交。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →