PrimeIntellect 开源 8 天前沿模型自主研究完整追踪数据
burny_tech · x · 2026-08-17
PrimeIntellect 公布了迄今为止最大的开放式实验数据,追踪了 10+ 个前沿模型在 8xH200 集群上进行的 100+ 次自主 AI 研究运行。
核心发现与数据内容:
- 任务设定:模型在沙箱环境中对 nanoGPT 优化器进行迭代,最长运行时间达 8 天。
- 表现亮眼:最佳运行结果填补了人类数月工作记录 82% 的性能差距。
- 数据开放:此次发布了完整的 traces、scratchpads 和 reasoning streams,这对全球致力于“自主研究”(autoresearch)的初创公司来说是极具价值的数据资产。
所属事件:Prime Intellect 发布最大规模自主研究实验与排行榜(11 条相关)→
「编程与Agent」频道最新
- 如何让 LLM 语音 Agent 稳定遵循长指令和设定人设? — alookass · 2026-08-17
- OpenAI 博客详解 AWS AgentCore 支付集成 — kleffew94 · 2026-08-17
- 改用语音提示词,成为提升 Agent 工作流的最廉价升级 — nestlyze · 2026-08-17
- 科研效率巨变:AI 代理19分钟搞定旧日数月工作 — heyneighbor · 2026-08-17
- 20 智能体并行实验:智能在连接而非模型 — gaganghotra_ · 2026-08-17
- 如何用LLM从工业手册提取寄存器映射?Reddit 用户求架构建议 — Plenty_Shine_8250 · 2026-08-17