实验室用 AI Agent 造模型:仅 0.7% 情况人工接管

alex_verem · x · 2026-09-20

开源模型 Atria Dawn 团队发布了一份自我分析报告,基于 769 条任务记录和 56 名成员的 Agent 日志,研究 AI Agent 如何参与自家模型的研发:

作者坦承两个隐忧:每个人类决策背后依赖的 AI 工作量已超出个人可核查范围,人可能沦为「只会说 yes 的审查者」;而且许多研究员为了省事直接关掉了权限审批——便利性而非规划决定了 AI 获得多大权限。模型本身在 16 项 benchmark 中拿了 5 项第一,但这份建造过程记录可能比成绩更有价值。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →