未发布的 Model 2 得分62.8%,距全替代研究员仅差22.2%
ChrisGPT · x · 2026-08-15
评论指出,Anthropic 尚未发布的 Model 2 在 CoBench v2 测试中得分 62.8%。据 Anthropic 估算,一个能够完全替代其研究人员的系统至少需达到 85% 的分数。这意味着 Model 2 目前仅落后约 22.2 个百分点,且该数据已有一个月的历史,暗示 RSI(递归自我改进)已近在咫尺。
所属事件:曝 Anthropic 未发布模型 CoBench 得分 62.8% 超 Mythos 5(2 条相关)→
「漫话AGI」频道最新
- Epoch 研究员列出决定 AI 影响的四大关键问题 — Jsevillamol · 2026-08-15
- 简历写反AI立场是职业自杀还是格调? — uwukko · 2026-08-15
- 计算机无法完成的不算数学:AI时代数学定义引热议 — pmddomingos · 2026-08-15
- 剑桥大学被指盲目推崇虚假声明,Arday事件引发反思 — Afinetheorem · 2026-08-15
- Munder Difflin:让数字克隆体通过共享知识库协作工作 — chaitanyagiri · 2026-08-15
- Arday造假事件引同情:建议离开公众视线疗伤 — doodlestein · 2026-08-15