迄今最大开源自主 Agent 科研实验:规模化运行时与多模型对比
eliebakouch · x · 2026-09-09
作者 eliebakouch 宣布完成迄今最大规模的开放实验:自主 Agent 在研究环境中自主迭代,扩大了运行时长、算力、模型与 harness 的多样性。
对比基准:Anthropic 系统卡中的「在 CPU 上优化 LLM 训练」、OpenAI GPT-5.6 做 nanogpt track 1,均不到一天;本实验规模更大,并公开了大量细节(完整 traces、中间草稿等),结果还在持续更新。
「编程与Agent」频道最新
- 开源 Aurora 网关用 Go 重写,自称比 LiteLLM 快 55 倍并修复 OpenCode 封锁 — entitybtw · 2026-09-09
- 人类靠“昨天 Amy 开的那个 issue”交流,agent 能听懂吗? — yoavgo · 2026-09-09
- 开源本地 prompt 优化器:GEPA 驱动 llama3.2 3B 分类准确率 39%→89% — MortisAndTen · 2026-09-09
- 开发者点赞 Amp 线程式 agent UI:比 Codex 更易追踪不杂乱 — carlosdponx · 2026-09-09
- Agent 时代「可读代码」重定义:关键变成上下文检索质量 — generativist · 2026-09-09
- Devin 入驻英伟达、GE、花旗、奔驰等巨头工程团队 — Sethwinterroth · 2026-09-09