蚂蚁集团发布 Marathoner:可连续工作 10 小时、千次工具调用的超长程智能体
antgroup · hf · 2026-09-30
蚂蚁集团提出 Marathoner,一个具备超长程自主执行能力的 agentic 模型。后训练管线包含:用 GitHub 大型仓库 1000+ 行新代码的 major release PR 合成任务级数据,并通过多任务链(Multi-Task Chaining)把多个任务串联成更高难度任务;用强教师模型配合多样化 harness 生成轨迹,做拒绝采样微调;强化学习阶段让模型在独立沙箱中真实执行 rollout,并提出 Later Stage Bonus Reward 奖励策略,显式鼓励模型在执行后期做出有意义的操作。在 5 个超长程任务基准上,Marathoner 相比基座模型持续大幅提升,甚至超过强专有模型;分析显示它能在高难任务上连续工作 10+ 小时、执行 1000+ 次工具调用。
「编程与Agent」频道最新
- Cube 发布:2 分钟开一台云电脑,让 Claude Code 合盖继续跑 — algo_diver · 2026-09-30
- 新玩法:自举「最优结果形状」的自动研究循环 — burny_tech · 2026-09-30
- Stack Overflow 现身 OpenAI DevDay,谈 Codex 助力新架构 — pchandrasekar · 2026-09-30
- 模型变强≠可删封装层:反方观点称复杂 agent 外壳仍在烧 token — max_paperclips · 2026-09-30
- 用 Groq + Hindsight 搭一个能从反馈中学习的代码审查 Agent — pasulabhavya · 2026-09-30
- OpenAI Dots 开源复刻 Open-Dots 24 小时斩获 4500+ GitHub 星 — matchaman11 · 2026-09-30