前沿模型AI研究实验:最佳运行结果闭合82%人类差距
eliebakouch · x · 2026-08-16
PrimeIntellect 运行了针对前沿模型 AI 研究能力的最大规模开放实验。实验涉及 10+ 模型的 100+ 次自主运行,在 8xH200 沙箱中运行长达 8 天,迭代优化 nanoGPT。结果显示,最佳运行弥补了由数十名人类花费数月建立的纪录 82% 的差距。
「编程与Agent」频道最新
- 定制化开发工具常遇尴尬,传统工具组合仍具优势 — bigblueboo · 2026-08-16
- AI中间产物泛滥,网友提议给智能体加垃圾回收分拣机制 — dht · 2026-08-16
- DeepSeek Harness 48小时破10万星,增速超 OpenClaw — Hesamation · 2026-08-16
- 前端趋势:因 AI 辅助开发,纯 HTML 网站或复兴 — gethackteam · 2026-08-16
- Spawn Games 更新:可联动最喜欢的 Agent 一起玩游戏 — TAbrodi · 2026-08-16
- Agent 选型指南:Opus 擅长 3D,Sol 音频表现出色 — nptacek · 2026-08-16