GPT-5.6 Sol ARC-AGI 提升 25%,推理 Token 降 6 倍

OpenAIDevs · x · 2026-08-17

GPT-5.6 Sol 在 ARC-AGI-3 基准测试中,通过 retained reasoning 和 compaction 技术,准确率从 13.3% 提升至 38.3%,同时输出 Token 消耗减少约 6 倍。此外,房产初创公司 Hypha AI 使用 GPT-5.6 Luna 进行文档提取,在保持 GPT-5.5 98% 准确率的同时,成本降至 1/18;金融研究工具 Rogo AI 则通过程序化工具调用,在匹配评估质量的前提下减少了 21% 的输入 Token。

所属事件:OpenAI 披露 GPT-5.6 降本增效表现(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →