Anthropic 首次自曝:Claude 主导 26% 研发,3 万智能体全天候工作
新智元 · wechat · 2026-09-18
Anthropic 首次公开三大内部 AI 研发指标。按 Epoch 六级自动化标准评估:Claude 已能自主「主导」约 26% 的核心研发工作,超过 90% 的研发流程达到人机深度协同,尚未有子任务实现完全 L5 闭环。内部平台日常并发运行约 3 万个研发智能体,Anthropic 为此建立双层监控:执行前实时扫描(8 月追踪超 10 亿次决策,约 0.002% 被阻断),加上每周离线筛查出约 10 万份可疑日志、50 起交人类专家终审;并通过独立身份标签与全透明公共消息总线防止智能体串通。
算力账本同样被公开:仅约 6% 的核心研发算力用于安全研究(AI 主导部分约 12%),Anthropic 称这是刻意从严的保守口径。公开这些指标意在建立行业透明度标准,并喊话其他前沿实验室(尤其被指影射 OpenAI)跟进披露、接受第三方(如 METR)验证。
所属事件:Anthropic 首晒内部指标:Claude 已主导 26% 研发(41 条相关)→
「漫话AGI」频道最新
- François Fleuret 梗图:38 亿年的碳基设计即将切换 — francoisfleuret · 2026-09-21
- 若人类级智能便宜到不计成本,十年建成戴森球够不够 — EigenGender · 2026-09-21
- 「让模型放马过来」:X 圈激辩当前模型离真实危险还有多远 — tszzl · 2026-09-21
- 开源前沿模型放开已久却无事发生,AI 末日论者遭反问 — tszzl · 2026-09-21
- AI 威权风险争论:政权作恶并不需要超危险级 AI — amplifiedamp · 2026-09-21
- 经济学家提出「混乱型工作」理论:两类工作难被 AI 取代 — ksprdk · 2026-09-21