METR 用 NanoGPT 测出 AI 优化能力的“支出视界”

gleech · x · 2026-08-04

METR 提出用“支出视界”衡量 AI 优化能力

这篇研究把 AI agent 在优化任务上的能力,定义为在人力、token 和算力成本共同约束下,谁更划算。作者提出一个叫 expenditure horizon(支出视界) 的指标:当预算低于某个点时,AI 更有效;超过这个点后,人类反而更划算。

论文的核心问题是:AI 到底在多大程度上加速了 AI 研发。作者认为直接测这个问题很难,于是用成本曲线交叉点来近似刻画。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →