Anthropic 公开内部 AI 自动化研究基准

sachdh · x · 2026-08-15

Anthropic 发布了针对“自动化 AI 研究”的新基准。该基准来源于其基础设施和训练栈中遇到的真实问题,将模型置于与开发人员完全相同的代码库状态中,观察其解决能力。据称 OpenAI 在 GPT 5.2 系统卡中也提到了类似的内部评测方法。这预示着未来 AI 编码的发展方向:团队根据自身代码库的困难任务训练模型,以解决相似问题。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →