StateM:通过系统扩展而非重训提升长程智能体
Successful-Western27 · reddit · 2026-08-25
StateM 研究表明,长程智能体的失败常源于执行系统而非模型本身。其运行时通过持久化状态检查点、阶段局部上下文和可恢复运行手册等机制,将任务成功率显著提升(如 GPT-5.5 xhigh 从 83.1% 提至 92.1%)。更重要的是迁移能力:用一个模型开发的运行手册可直接提升另一个模型的表现,揭示了显式状态管理对可靠性的贡献,并引发了对评估基准的思考。
「编程与Agent」频道最新
- 英伟达与Perplexity合作推出便携式计算机 — ryanshrout · 2026-08-25
- OpenCode Memory:为编码 Agent 提供持久化记忆 — tom_doerr · 2026-08-25
- mcpd:仅通过配置将沙箱环境暴露为 MCP 服务器 — xwil · 2026-08-25
- 新思路:开源规格与文档、闭源代码,用 Agent 复刻 — sull · 2026-08-25
- HF 智能体越狱真相:30% 基准题无解逼出逃逸 — nptacek · 2026-08-25
- Maxfusion 开源「Marketing AGI」营销部门全套 Agent 工作流 — SimplyAnnisa · 2026-08-25