Apodex 1.1:专为 Agent 任务优化的模型

rohanpaul_ai · x · 2026-09-02

Apodex 发布了专有模型 Apodex 1.1。在 Artificial Analysis 指数中得分 44,但在衡量真实世界 Agent 工作的 GDPval-AA v2 测试中达到 1348 Elo,超过了通用智力得分更高的模型。作者指出,模型选择不应只看通用推理基准,而应关注其在 Agent 循环中利用工具完成目标的实际能力。Apodex 1.1 在专业和 Agent 任务上表现出了异常集中的优势。

所属事件:Apodex 1.1 发布,智能体评测表现亮眼(3 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →