爆料:Anthropic 内部模型在 CoBench 上超越 Mythos 5,接近替代研究员
daniel_mac8 · x · 2026-08-15
据爆料,Anthropic 测试了未发布的 'Model 2',在 CoBench v2 上得分比 Mythos 5 高 12.5 个百分点。CoBench 测试模型解决历史 AI 研发任务的能力。报告估计得分 85% 的模型可替代 Anthropic 研究员,暗示 AGI 临近。
所属事件:曝 Anthropic 未发布模型 CoBench 得分 62.8% 超 Mythos 5(2 条相关)→
「漫话AGI」频道最新
- ARC-AGI-3 引入测试时记忆,探索交互式智能 — GregKamradt · 2026-08-15
- 人类价值正因智力和灵巧性的量产而面临重估 — VraserX · 2026-08-15
- Pedro Domingos 比喻:AI 是流体,Agent 是分子 — pmddomingos · 2026-08-15
- 色情 AI 若有意识意味什么?引发伦理争论 — repligate · 2026-08-15
- 多智能体系统是下一代抽象,或将造就超级智能 — scaling01 · 2026-08-15
- Tim Ferriss:AI已杀死非虚构类书籍?销售数据与个人案例揭示冲击 — TuhinChakr · 2026-08-15