Anthropic 26% 研发由 Claude 主导,学者提出「理解审计」应对递归自我改进
ronbodkin · x · 2026-10-09
Fathom 组织与研究者 Ron Bodkin、Tom Everitt(ghadfield)、Bahrad 等发布新预印本,回应 AI 研发日益由 AI 完成的趋势:
- 据引述,Dario Amodei 称递归自我改进「已在全行业开始发生」;Claude 主导了 Anthropic 约 26% 的研发工作,参与协作的部分超过 90%。
- Anthropic、OpenAI、Google 的新代码已有 75% 以上由 AI 编写;而开源 AI 项目每行代码收到的评审意见自 2024 年初以来减少了约一半,人工审查可能跟不上节奏。
论文提出「理解审计」(comprehension audits):由独立审计方挑选重要的 AI 研发工作,要求负责团队像答辩论文一样解释自己做了什么、怎么做的、学到了什么。标准务实——团队需证明对其工作的设计、实现与结果有实质性理解,但不必解释模型行为的每个细节。
所属事件:新论文提出「理解审计」:人类看不懂就暂停 AI 自我改进(9 条相关)→
「漫话AGI」频道最新
- 学者推荐:一篇谈「世界被解决后如何留住自由」的罕见清醒文章 — gleech · 2026-10-09
- AI 热潮推高租金,旧金山 Castro 老店因房租涨 3 倍关门 — mobav0 · 2026-10-09
- AI 热潮冲击旧金山:流量、天价房租、餐馆接连关门 — mobav0 · 2026-10-09
- 杰文斯悖论救不了白领岗位?估算仅两成行业需求扩张 — simmol · 2026-10-09
- Bostrom:人类想象 AI 的好处,就像猿猴想象做人 — beffjezos · 2026-10-09
- 诺贝尔经济学奖得主谈 AI 与就业, Reddit 热传配图 — Tgoc · 2026-10-09