GitHub Copilot 省钱四招:删行号省 5% 推理成本,缩短工具输出反而更贵
GitHub Blog AI/ML · rss · 2026-09-03
GitHub 团队分享了 Copilot 提升编码智能体成本效率的四项改动,核心理念是「优化任务结果而非单次调用 token 数」。
局部最优陷阱:他们评测了缩短 shell 输出的工具 RTK,结果发现被截断的信息会迫使模型重新读取输出或重跑命令,单次响应变短但整个任务 token 更多、耗时更长——单次工具调用的 token 数是错误的优化目标。
四项落地改动
- 选择性输出压缩:只压缩 install/build/test 等重复噪音,保留 cat、git diff 等源码类输出原样,并保留完整原始输出的恢复路径;压缩触发时任务成功率无统计显著回归,agent 极少回读原文。
- 删除无用格式:view 工具去掉行号前缀(当前编辑工具靠上下文匹配而非行号),离线推理成本降约 5%,在线实验用户日均推理成本降约 3%。
- Meta-prompting 压缩提示词:让 Copilot 自己迭代改写 task 工具的指令,提示词缩短约一半,并用行为测试守护关键行为;首次在线实验曾发现离线评估漏掉的回归。
- 后台工作免检索直送:已完成的任务结果直接交付,省去额外取回步骤。
方法论:所有改动先离线 agentic 基准评测,再在线 A/B 验证,用「AI-credit」成本指标统一衡量。
「编程与Agent」频道最新
- Fable 5.1 生成 three.js 网站实测:快且精准,但细节仍需人把关 — repligate · 2026-09-03
- SentinelX 开源:让 LLM 安全接管你的 Linux 服务器终端 — CarolusX74 · 2026-09-03
- 连载 30 天:用 fable 5.1 给户外机器人写出无线手柄控制器 — _Stocko_ · 2026-09-03
- 试水 AmpCode:可用 ChatGPT 订阅、每线程一台云电脑,槽点是吉祥物 Puck — carlosdponx · 2026-09-03
- 一人一 Agent 独立 microVM:语言学习产品上线生产环境的三个教训 — maritime_sh · 2026-09-03
- 断网手写 10 页文档后让 Agent 做成 PPT:作者发现自己文字像 AI 糊弄产物 — cnakazawa · 2026-09-03