极低成本训练模型跑通SWE-bench,性能比肩Claude 2
马克斯·普朗克研究所与斯坦福大学学者探索了在极低预算下“速通” SWE-bench 的极限。基于 Andrej Karpathy 的 nanochat 项目,研究人员仅花费 60 至 1000 美元的算力成本从零训练模型,最终在 SWE-bench 上达到了 11% 的解决率。实验表明,极低成本训练出的高性能编程模型,其表现已能比肩 Claude 2 等早期大型模型。
2026-08-14 ~ 2026-08-14 · 2 条相关
- 60美元训练模型跑通SWE-bench,性能比肩Claude 2 — StanfordAILab · 2026-08-14
- 仅花 1000 美元从零训练,模型在 SWE-bench 达 11% 解决率 — sanmikoyejo · 2026-08-14