Agent harness 分级榜引争议:用自定义压缩的应大幅打折
pvncher · x · 2026-10-06
有人发布 agent harness tier list 后,Paul(pvncher)提出质疑:凡是在 OpenAI 或 Anthropic 模型上做自定义 compaction 的 harness 都应大幅降权。他追问:如果用第三方工具跑这些模型,理由是什么?它凭什么跑赢官方原生 harness?
所属事件:Agent harness 分级榜引发自研与锁定之争(4 条相关)→
「编程与Agent」频道最新
- TanStack 推出 MCP Server,AI 助手可检索文档并脚手架新项目 — modelcontextprotocol · 2026-10-06
- SnapRender 发布 MCP,让 AI 助手直接抓取任意网页截图 — modelcontextprotocol · 2026-10-06
- SFT再RL仍会死循环:29%跑满轮次上限,on-policy数据才是关键 — VikParuchuri · 2026-10-06
- 纯 RL 后训练消灭智能体工具调用死循环:SFT 循环率 92% 降至 0 — VikParuchuri · 2026-10-06
- Datalab 实测:纯 RL 训练让 Agent 零死循环,SFT 循环率高达 92% — VikParuchuri · 2026-10-06
- 编码 agent 让研究范围失控,学者警惕"研究垃圾"副作用 — rishabh16_ · 2026-10-06