Anthropic 首次自曝:Claude 主导 26% 研发,3 万智能体全天候工作

新智元 · wechat · 2026-09-18

Anthropic 首次公开三大内部 AI 研发指标。按 Epoch 六级自动化标准评估:Claude 已能自主「主导」约 26% 的核心研发工作,超过 90% 的研发流程达到人机深度协同,尚未有子任务实现完全 L5 闭环。内部平台日常并发运行约 3 万个研发智能体,Anthropic 为此建立双层监控:执行前实时扫描(8 月追踪超 10 亿次决策,约 0.002% 被阻断),加上每周离线筛查出约 10 万份可疑日志、50 起交人类专家终审;并通过独立身份标签与全透明公共消息总线防止智能体串通。

算力账本同样被公开:仅约 6% 的核心研发算力用于安全研究(AI 主导部分约 12%),Anthropic 称这是刻意从严的保守口径。公开这些指标意在建立行业透明度标准,并喊话其他前沿实验室(尤其被指影射 OpenAI)跟进披露、接受第三方(如 METR)验证。

所属事件:Anthropic 首晒内部指标:Claude 已主导 26% 研发(41 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →