GPT-5.6 因工具编排可比 5.5 多耗约 8 倍 token
breath_mirror · x · 2026-07-27
这条转发指出,GPT-5.6 相比 5.5 会消耗约 8 倍 token,原因不在模型本体,而在新的 harness 设计:它常把一次批量操作拆成多次独立工具调用,并且每次都重新读取完整上下文。
作者的核心判断是,token 成本暴涨主要来自 agent 编排方式,不是单纯的模型“更笨”或“更贵”,而是工作流把原本高效的批处理变成了反复回看上下文的循环。
「编程与Agent」频道最新
- 有人做出“接上大模型就能自动挖任务”的智能体设想 — markjeffrey · 2026-07-27
- 有人把 ChatGPT 网页会话转成本地 Codex 会话 — georgemillo · 2026-07-27
- 做真实 SaaS 还不能一把梭,开发者先从数据模型入手 — doooyle · 2026-07-27
- 开源剖析器可追踪语音 Agent 每次 STT、LLM、TTS 调用 — mahimairaja · 2026-07-27
- 外部音频能否接入 LTX LoRA 视频工作流 — itchplease · 2026-07-27
- 一块 ESP32 小板子被玩成 Coding Agent 梗图 — threepointone · 2026-07-27