PostTrain Agent 全自动后训练拿 PostTrainBench 榜首,距人类专家仅差 4.5 分
jiqizhixin · x · 2026-10-10
AIBuildAI 发布 PostTrain Agent,一个面向 LLM 后训练的递归自我改进(RSI)智能体,宣称在 PostTrainBench 上以 46.6 分登顶,超过所有前沿模型与 agent 系统,逼近人类专家的 51.1 分,且整个后训练闭环零人工干预。
其核心主张:通常交付一个后训练模型需要经验团队数周时间,每个实验都烧大量算力;PostTrain Agent 则接受一个基座模型、目标能力和算力预算,自主设计后训练算法、收集并整理数据、写代码、跑实验并迭代改进,最终交出训练好的模型。
团队称代码、知识库与技术细节已公开。注意这是厂商自宣成绩,榜单由其自身提出,具体含金量有待第三方验证。
「模型」频道最新
- 仅 7% 训练算力用于预训练?repligate 追问这数字到底指什么 — repligate · 2026-10-10
- 疑似基于 GPT-6 Luna 的记忆整合模型 Memory4 Dream 现身 — lyraxana · 2026-10-10
- Grok Bot 进化为 X 舆情分析器,自动监控并每日生成简报 — FinanceYF5 · 2026-10-10
- 印度医生团队正为医疗 AI 出题,首推放射学考试 — DrDatta_AIIMS · 2026-10-10
- AI 日报:OpenAI 数学论文破 700 篇,Mistral 开源新模型 — FinanceYF5 · 2026-10-10
- 纽约 AI 晚宴纪要:推理优化靠 agent 找、代码审查已不划算 — paulnovosad · 2026-10-10