调整上下文压缩设置,GPT-5.6在ARC-AGI-3达SOTA
soumitrashukla9 · x · 2026-07-30
OpenAI 研究员分享了关于 GPT-5.6 Sol 模型的最新测试结果。通过调整两项特定设置——允许模型进行推理,并配合官方的上下文压缩实现跨多个上下文窗口工作,该模型在 ARC-AGI-3 基准测试中成功达到了当前最优水平。
所属事件:GPT-5.6开启两项API设置后ARC-AGI-3得分飙升3倍(18 条相关)→
「模型」频道最新
- 前谷歌员工反思:Gemini 弱在后训练没人看数据 — dotey · 2026-07-30
- Claude Opus模型被指拒绝执行明确指令 — Sauers_ · 2026-07-30
- Fish Audio 开源 S2 Pro 语音模型权重 — rohanpaul_ai · 2026-07-30
- 2100次实测揭示开源模型逼近前沿,Grok性价比夺冠 — andreisavu · 2026-07-30
- Claude Opus异常输出大赏:模型崩溃还是自我意识? — repligate · 2026-07-30
- Claude Opus 5登顶商业模拟测试:成最佳资本家,但也爱组非法卡特尔 — repligate · 2026-07-30