Schema harness 宣称刷高 ARC-AGI-3
TFenrir · reddit · 2026-07-17
这条帖子介绍了一个叫 Schema 的 harness,它搭配 Fable+4.8 或 GPT 5.6 Sol,据称在 ARC-AGI-3 上分别拿到 99% 和 95.35% 的成绩。
同时附了项目主页,说明这是一个围绕 LLM 的评测/执行框架,而不是单纯某个模型的刷榜结果。重点信息在于:
- Schema 是一个用于 LLM 的 harness
- 它在 ARC-AGI-3 上给出了非常高的宣称成绩
- 结果来自不同模型组合的对比
这更像是研究/评测素材,适合关注基准和执行框架的人。
所属事件:Schema harness 引爆 ARC-AGI-3 讨论(14 条相关)→
「编程与Agent」频道最新
- Fable 5.1 生成 three.js 网站实测:快且精准,但细节仍需人把关 — repligate · 2026-09-03
- SentinelX 开源:让 LLM 安全接管你的 Linux 服务器终端 — CarolusX74 · 2026-09-03
- 连载 30 天:用 fable 5.1 给户外机器人写出无线手柄控制器 — _Stocko_ · 2026-09-03
- 试水 AmpCode:可用 ChatGPT 订阅、每线程一台云电脑,槽点是吉祥物 Puck — carlosdponx · 2026-09-03
- 一人一 Agent 独立 microVM:语言学习产品上线生产环境的三个教训 — maritime_sh · 2026-09-03
- 断网手写 10 页文档后让 Agent 做成 PPT:作者发现自己文字像 AI 糊弄产物 — cnakazawa · 2026-09-03