Apodex 1.1 发布:以「可验证的完整工作」为能力单位的 agent 模型
rohanpaul_ai · x · 2026-09-04
Rohan Paul 解读 Apodex AI 的 Apodex 1.1:它不以单次回答质量衡量,而是训练模型接管完整工作——在数百步的任务中维持工作区状态、从失败中恢复、产出可验证的成果物。
- 任务可从原始文件、数据集、表格、论文、图片或代码起步,系统自行检查、选方法、跑代码、维护任务状态并恢复故障。
- 两条扩展路径:Environment Scaling 扩充可执行的文件/搜索/代码环境;Agentic Coordination Scaling 训练把长任务拆分给多个 agent、把部分结果汇入共享状态并按证据修订计划。
- AgentOS 让文件、工具状态、artifact、依赖与协调状态持久化;subagent 可在所有分支完成前先返回有用结果,主 agent 能重定向未完成工作而不丢弃仍有效的进展。
- 官方公布成绩称 Apodex 1.1 配合 Agent Team 在专业工作、金融、科学、推理与搜索领域处于领先梯队。
所属事件:Apodex 1.1 发布:以可验证完整工作训练 agent(2 条相关)→
「编程与Agent」频道最新
- WebMCP 黑客松佳作:一个 URL 即可给 Agent 一台一次性电脑 — prd_008 · 2026-09-04
- Grok Bot 发 50 份 200 美元额度码,作者分享编排 bot 工作流 — omarsar0 · 2026-09-04
- 开发者用 Claude Max 五个月大幅改进 App Store Connect CLI — rudrank · 2026-09-04
- WHALE 提出:联合优化 LLM 权重与外挂 harness 的简单配方 — lateinteraction · 2026-09-04
- Apollo 发布实时编码 Agent 监视器 Watcher Live,可拦截危险操作 — MariusHobbhahn · 2026-09-04
- 顾问赴哈佛培训 Opportunity Insights 团队用 agentic coding — aniketapanjwani · 2026-09-04