极低成本训练模型跑通SWE-bench,性能比肩Claude 2

马克斯·普朗克研究所与斯坦福大学学者探索了在极低预算下“速通” SWE-bench 的极限。基于 Andrej Karpathy 的 nanochat 项目,研究人员仅花费 60 至 1000 美元的算力成本从零训练模型,最终在 SWE-bench 上达到了 11% 的解决率。实验表明,极低成本训练出的高性能编程模型,其表现已能比肩 Claude 2 等早期大型模型。

2026-08-14 ~ 2026-08-14 · 2 条相关