ARC-AGI-3新思路:先摸规则
GregKamradt · x · 2026-07-18
这条转述在说一个很实用的策略:遇到没见过的新任务或新游戏时,智能体不该一上来就直奔目标,而应先把动作花在“摸清规则”上,尽量明确所有约束后再追求最优解。
上下文里提到,[schema] 这个 harness 在 ARC-AGI-3 Public set 上取得了很高成绩:Opus 4.8 + Fable 5 达到 99% RHAE,GPT-5.6 Sol 也有 95.35%。转发者强调,这种“先理解规则、再高效达成目标”的方法论,可能不只适用于 ARC-AGI 类基准,也适用于真实任务。
所属事件:Schema harness 引爆 ARC-AGI-3 讨论(14 条相关)→
「模型」频道最新
- 传 OpenAI 在 Astra 中使用 neuralese 循环变换器,新的 scaling 轴浮出水面 — imadade · 2026-09-03
- XBOW 团队拿下今年首个 Chrome 全链漏洞利用奖励 — moyix · 2026-09-03
- Gemini 3.8 Flash 的 Pareto 最优地位仅维持了 5 小时 18 分钟 — alejandroll10 · 2026-09-03
- 双 DGX Spark 实测:GLM-5.3-Flash 写作与视觉胜过 DeepSeek-V4-Flash — kuhunaxeyive · 2026-09-03
- Anthropic 商务智能体只建购物车交人工结账,被赞退款风控思路对 — HaktanSuren · 2026-09-03
- Qwen3.8 27B Q8 翻车:12 万 token 后发现根本没读计划,自行实现别的功能 — KingCpzombie · 2026-09-03