Anthropic 展示 AI 闭环改进模型,超人类研究方向

kimmonismus · x · 2026-08-29

Anthropic 发布最新研究,展示了接近递归自我改进的流程:Claude 被用于改进其他 AI 模型的对齐。模型自主搜索文献、提出方法、创建训练数据、训练并评估结果。在 10 项测试中,它修复了所有对齐失效问题且未降低通用能力,甚至用较弱的 Sonnet 5 在 60 小时内将早期 Opus 4.8 的对齐水平提升至接近生产版。实验表明,AI 指导的研究方向平均 6 小时内即可超越人类专家的提议。虽然改进后的模型尚未成为下一代研究员以闭合循环,但核心环节已基本具备,这是向递归自我改进迈出的重要一步。

所属事件:Anthropic 自动化对齐研究:Claude 自主修复失对齐、跑赢人类专家(14 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →