未发布的 Model 2 得分62.8%,距全替代研究员仅差22.2%

ChrisGPT · x · 2026-08-15

评论指出,Anthropic 尚未发布的 Model 2 在 CoBench v2 测试中得分 62.8%。据 Anthropic 估算,一个能够完全替代其研究人员的系统至少需达到 85% 的分数。这意味着 Model 2 目前仅落后约 22.2 个百分点,且该数据已有一个月的历史,暗示 RSI(递归自我改进)已近在咫尺。

所属事件:曝 Anthropic 未发布模型 CoBench 得分 62.8% 超 Mythos 5(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →