爆料:Anthropic 内部模型在 CoBench 上超越 Mythos 5,接近替代研究员

daniel_mac8 · x · 2026-08-15

据爆料,Anthropic 测试了未发布的 'Model 2',在 CoBench v2 上得分比 Mythos 5 高 12.5 个百分点。CoBench 测试模型解决历史 AI 研发任务的能力。报告估计得分 85% 的模型可替代 Anthropic 研究员,暗示 AGI 临近。

所属事件:曝 Anthropic 未发布模型 CoBench 得分 62.8% 超 Mythos 5(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →