StateM:通过系统扩展而非重训提升长程智能体

Successful-Western27 · reddit · 2026-08-25

StateM 研究表明,长程智能体的失败常源于执行系统而非模型本身。其运行时通过持久化状态检查点、阶段局部上下文和可恢复运行手册等机制,将任务成功率显著提升(如 GPT-5.5 xhigh 从 83.1% 提至 92.1%)。更重要的是迁移能力:用一个模型开发的运行手册可直接提升另一个模型的表现,揭示了显式状态管理对可靠性的贡献,并引发了对评估基准的思考。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →