60美元训练模型跑通SWE-bench,性能比肩Claude 2

StanfordAILab · x · 2026-08-14

开发者基于 Karpathy 的 nanochat 项目进行了 SWE-bench 速度挑战,实现了极低成本训练出高性能编程模型。

实验结果:

该实验从随机初始化的模型权重开始训练,证明了通过优化训练流程,可以用极低的算力成本复现甚至超越早期前沿模型的编程能力。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →