前沿模型自主研究能力逼近人类,8天迭代补足82%差距
eliebakouch · x · 2026-08-16
PrimeIntellect 发布了迄今为止最大规模的开放实验,探索前沿模型进行 AI 研究的能力。实验涉及 10+ 模型、100+ 次自主运行,在 8xH200 沙箱中运行长达 8 天,针对 nanoGPT 优化器赛道进行迭代。结果显示,表现最好的运行补足了人类专家团队耗时数月建立的 82% 性能差距。
所属事件:Prime Intellect 发布最大规模 AI 自主研究实验结果(8 条相关)→
「研究」频道最新
- ORBIT 训练范式:提升时序基础模型零样本预测能力 — chaumian · 2026-08-16
- Hamilton-Zero:求解量子基态的神经网络基础模型 — burny_tech · 2026-08-16
- Spatial Memory Agent:无参数更新的空间智能框架 — burny_tech · 2026-08-16
- LOPD自蒸馏新法:胜GRPO,rollout预算仅三成 — burny_tech · 2026-08-16
- Chat模板换行无损失信号,导致模型采样时可能破坏模板 — kalomaze · 2026-08-16
- IROS 2026 研讨会征稿:聚焦可扩展触觉感知与灵巧操作 — _krishna_murthy · 2026-08-16