模型找 bug 能力越强成本指数级上涨,Paweł Huryn 实测揭示性价比曲线

garrytan · x · 2026-09-24

Paweł Huryn 测试了各家模型在「找出代码中人为埋入 bug」任务上的表现,发现性能提升与调用成本呈指数关系(横轴为对数刻度),并用 ChatGPT 叠加了趋势线:位于趋势线上方的模型属于「性价比划算」。Paul Graham 转发了这一观察。这条曲线给「该用哪个模型做代码审查」提供了直观参考——不一定要追最贵的模型。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →