Anthropic 展示 AI 研究员自主改进其他模型的对齐

VraserX · x · 2026-08-30

VraserX 指出 Anthropic 刚展示了 AI 研究员能够自主改进其他 AI 模型的对齐(alignment),并认为这是一个里程碑:AI 不再只帮助构建更强的 AI,而是开始帮助解决更强 AI 带来的问题。

所属事件:Anthropic 发布自动化对齐研究员:效果全面超人类,成本仅 4 美元/时(20 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →