OpenAI联手AWS实测:GPT-5.6智能体任务成本骤降82%
新智元 · wechat · 2026-08-28
OpenAI 与 AWS 公布联合测试结果:通过优化环境与模型,GPT-5.6 Terra 在 Kiro 平台上完成 Terminal-Bench 2.1 任务的成本降低了约 82%。
优化逻辑
成本的 62% 差距并非来自官方降价(Terra 仅降 20%),而是来自效率提升:
- 减少模型 Token 吐出量。
- 减少工具调用次数。
- 避免失败重试和路径绕远。
框架与模型分工
测试表明,账单成本受「智能体框架 + 模型」组合影响巨大。Kiro 采用 Spec-driven 流程,先拆解需求再交给模型,大幅节省了原本会浪费在试错上的 Token。此外,OpenAI 建议在流水线中让 Sol 做规划,Luna 做实施,以优化性价比。
竞争格局
GPT-5.6 系列(Sol/Terra/Luna)已上线 AWS Kiro,与 Claude Fable 并列。Kiro 采用了隐藏思维链策略。OpenAI 此举意在 AWS 的地盘与 Anthropic 竞争,评价标准也从单纯的「准确率」转向「分数与成本的平衡」。
「编程与Agent」频道最新
- 前 Anthropic 工程师:7 节点 AI 图每月 6 美元抓住昂贵评测系统的漏网失败 — Aiden_Tech_Ai · 2026-08-28
- Grok Bot 实测报告:读百万帖的 AI 员工不是新模型而是包装革命 — Scobleizer · 2026-08-28
- ChatGPT 云浏览器实测:搞定车管所续期与比价 — prd_008 · 2026-08-28
- 用 Cursor 抓取网页内容,15 分钟搞定设计文案填充 — floguo · 2026-08-28
- VGPU 新品实测:Claude 设计力完胜 Codex — floguo · 2026-08-28
- 弃用 Claude 原生连接器,Glean 助企业省 50 万美元 — verrsane · 2026-08-28