Ruslan 认为通用 Agent Harness 终将输给长程 RL 模型

ruslansv · x · 2026-07-27

作者认为,很多人还相信一个足够复杂的通用 harness,能够长期和那些已经在长时程 agent 轨迹上做过 post-training / RL 的模型竞争,这种想法其实是在“自我安慰”。

他给出的判断是:

他把这种赌注类比为:曾经以为更好的 prompt engineering 能永久跑赢更强的 base model。

所属事件:通用 Agent Harness 难敌长程 RL 模型(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →