Ruslan 认为通用 Agent Harness 终将输给长程 RL 模型
ruslansv · x · 2026-07-27
作者认为,很多人还相信一个足够复杂的通用 harness,能够长期和那些已经在长时程 agent 轨迹上做过 post-training / RL 的模型竞争,这种想法其实是在“自我安慰”。
他给出的判断是:
- 通用 scaffolding 仍然有用,尤其是面对 实验室没见过的组织内分布;
- 也适合在 不同模型版本之间快速迁移;
- 但它不是对“模型已经内化了核心长程行为”这一点的长期替代。
他把这种赌注类比为:曾经以为更好的 prompt engineering 能永久跑赢更强的 base model。
所属事件:通用 Agent Harness 难敌长程 RL 模型(2 条相关)→
「编程与Agent」频道最新
- Planr 新增实时工作流地图,追踪多智能体阻塞与依赖 — kevinkern · 2026-07-27
- 人离开 4 小时,自治工程系统连发 7 个生产 PR — bestofdesp · 2026-07-27
- AI 编程 agent 正在用工具测试自己造的 AI 工具 — carsonfarmer · 2026-07-27
- Codex 绕过 AllTrails 验证码,自动抓取徒步数据 — yacineMTB · 2026-07-27
- 开源 SafeAI 新增 8 类 AI 能力检测,5 天成本约 8 美元 — IkarusCareer · 2026-07-27
- Opus 5 结合 Roblox MCP 做了个可爱演示 — JasonBotterill · 2026-07-27