迄今最大开源自主 Agent 科研实验:规模化运行时与多模型对比

eliebakouch · x · 2026-09-09

作者 eliebakouch 宣布完成迄今最大规模的开放实验:自主 Agent 在研究环境中自主迭代,扩大了运行时长、算力、模型与 harness 的多样性。

对比基准:Anthropic 系统卡中的「在 CPU 上优化 LLM 训练」、OpenAI GPT-5.6 做 nanogpt track 1,均不到一天;本实验规模更大,并公开了大量细节(完整 traces、中间草稿等),结果还在持续更新。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →