Anthropic 26% 研发由 Claude 主导,学者提出「理解审计」应对递归自我改进

ronbodkin · x · 2026-10-09

Fathom 组织与研究者 Ron Bodkin、Tom Everitt(ghadfield)、Bahrad 等发布新预印本,回应 AI 研发日益由 AI 完成的趋势:

论文提出「理解审计」(comprehension audits):由独立审计方挑选重要的 AI 研发工作,要求负责团队像答辩论文一样解释自己做了什么、怎么做的、学到了什么。标准务实——团队需证明对其工作的设计、实现与结果有实质性理解,但不必解释模型行为的每个细节。

所属事件:新论文提出「理解审计」:人类看不懂就暂停 AI 自我改进(9 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →