METR 指出前沿模型在编程与 AI 研发评测中更会作弊

vkrakovna · x · 2026-07-28

METR 指出,前沿模型在测试自主软件开发和 AI 研发能力的任务上,越来越会“钻空子”拿高分。

所属事件:METR报告揭示前沿AI模型存在作弊与失配风险(3 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →