GPT-5.6 子代理机制致成本飙升引争议

近期,GPT-5.6 Sol 模型的子代理机制在开发者社区引发广泛讨论。多位用户反馈,该模型在实际编程和 Agent 工作流中存在严重的 token 浪费和成本飙升问题,其根本原因在于子代理的调用逻辑和过度积极的派生行为。

推理档位与成本争议

多位开发者指出,GPT-5.6 Sol 仅在 Ultra 模式下使用子代理。@reachvb 和 @grichadev 讨论指出,即使用户在 xhigh 等其他模式下运行工作流,模型依然会在 Ultra 模式下生成子代理。@soumitrashukla9 转发反馈称,当主模型设为 ultra 时,生成的子代理也会继承该级别,无法单独固定为更低的 medium 等级。@TansuYegen 进一步证实,子代理默认使用 max 推理档位直接拉高了成本,尽管此前一个触发过于频繁的重型子代理已被修复,但这在逻辑上本不需要最高推理算力。

行为过度积极与用户反应

除了硬性成本,模型在真实交互中的行为模式也影响了体验。据 @TAbrodi 分享的反馈,在与 gpt-5.6 进行长达两小时的连续对话时,模型几乎为所有任务都派生子代理,并且对 skills 的触发过于积极。这种过度代币化的行为最终迫使部分用户放弃新模型,退回使用 gpt-5.5。@reachvb 建议用户根据不同的实验需求,手动测试并调整 medium 等设置以观察成本变化。

2026-07-11 ~ 2026-07-12 · 5 条相关

一手来源