伯克利研究称 AI 模型真实工作任务得分低于 25%

arknightstranslate · reddit · 2026-07-21

一篇报道转述了 UC Berkeley 相关研究的结论:当前 AI 模型在真实工作任务上的表现,距离“人类水平”还很远。 - 文章标题直接给出的核心数字是:模型在真实工作任务上的得分 **低于 25%**。 - 这条帖子本质上是在讨论一项研究/评测的主要发现:AI 在演示和局部能力之外,离端到端完成现实工作仍有明显差距。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →