OpenAI 揭示上下文压缩机制,GPT-5.6 ARC-AGI-3 成绩飙升至 38%
ilanbigio · x · 2026-07-30
OpenAI 工程师发文指出,模型评测通常不应在隔离环境下进行。当为模型启用上下文压缩(compaction)与推理记忆保留(reasoning retention)机制后,模型在复杂任务上的表现有显著提升。
核心评测数据:
- 在启用这些机制后,GPT-5.6 Sol (max) 在 ARC-AGI-3 基准测试中的得分从 13% 大幅跃升至 38%。
- 取得这一成绩的同时,消耗的 Token 数量反而减少了 6 倍。
这表明有效的上下文管理和记忆压缩对于维持长程推理能力至关重要。
所属事件:GPT-5.6开启两项API设置后ARC-AGI-3得分飙升3倍(14 条相关)→
「模型」频道最新
- DeepSeek 延迟发布 V4,坚持模型与工程框架协同优化 — teortaxesTex · 2026-07-30
- ThursdAI直播预告:探讨1.56TB的Kimi K3检查点 — altryne · 2026-07-30
- Kimi K3 递归自我改进 Cline,终端基准得分升至 88.8% — teortaxesTex · 2026-07-30
- 开发者痛批AI圈“造假”演示:Claude Opus神级表现实为夸大 — wavefnx · 2026-07-30
- OpenRouter 数据:Together 提供 Kimi K3 最低价与最高缓存命中率 — zhyncs42 · 2026-07-30
- 微软向华尔街展露野心:自研模型与工具全面对标 OpenAI — TechCrunch AI · 2026-07-30