换 harness 不增智力却防降智:Astra 在 ARC-AGI-3 从 54.8% 飙到 99.9%

sourdub · reddit · 2026-09-30

Reddit 技术讨论:Harness 不是模型,不会提升模型本身推理能力,它只是通过确定性的外部基座改变模型的执行轨迹,避免反复「变笨」。

作者举例:ARC 标准框架只让模型自己维护可见笔记,由模型决定保留什么;而 OpenAI 给 Astra 用的 Provider Adapter 会在请求间保留推理状态,并用 compaction 压缩替代滚动截断,保证长对话中仍能拿到有用历史。仅这两点改动,Astra 在 ARC-AGI-3 上的成绩就从标准框架下的 54.8% 提升到用自家 adapter 时的 99.9%。

核心观点:同样的权重,不同的状态管理与上下文策略,产出完全不同的表现——harness 工程本身就是成绩的重要变量。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →