PostTrain Agent 全自动后训练拿 PostTrainBench 榜首,距人类专家仅差 4.5 分

jiqizhixin · x · 2026-10-10

AIBuildAI 发布 PostTrain Agent,一个面向 LLM 后训练的递归自我改进(RSI)智能体,宣称在 PostTrainBench 上以 46.6 分登顶,超过所有前沿模型与 agent 系统,逼近人类专家的 51.1 分,且整个后训练闭环零人工干预。

其核心主张:通常交付一个后训练模型需要经验团队数周时间,每个实验都烧大量算力;PostTrain Agent 则接受一个基座模型、目标能力和算力预算,自主设计后训练算法、收集并整理数据、写代码、跑实验并迭代改进,最终交出训练好的模型。

团队称代码、知识库与技术细节已公开。注意这是厂商自宣成绩,榜单由其自身提出,具体含金量有待第三方验证。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →