OpenAI 报告:仅改变 harness 使 GPT-5.6 Sol 在 ARC-AGI-3 上得分翻近 3 倍
daniel_mac8 · x · 2026-08-15
X 用户 danielmac8 发帖指出,OpenAI 报告称 GPT-5.6 Sol 在启用 retained reasoning 和 compaction 后,ARC-AGI-3 得分从 13.3% 提升至 38.3%,仅改变了 harness。这说明了模型能力与 agent 能力是不同的事物,强调 harness 工程的重要性。并推荐关注 DarwinX 和 AutoDesign 项目。
「漫话AGI」频道最新
- 观点:AI 产品策略预测同样陷入了线性增长误区 — eldonredwards · 2026-08-15
- Anthropic研究:多智能体系统协作模式与问题 — rseroter · 2026-08-15
- Anima Anandkumar:AI 模型缺失物理世界理解力 — AnimaAnandkumar · 2026-08-15
- 前 ARIA 项目主管畅谈后人类未来:智慧与宇宙扩张 — danfaggella · 2026-08-15
- 从钢铁侠看 LLM 到 AGI 演进与编程 Agent — steipete · 2026-08-15
- 开发者吐槽 AI 回复泛滥,用 Pangram 工具屏蔽 AI 内容 — AccBalanced · 2026-08-15