Anthropic 报告曝光超 Mythos5 内部模型
Anthropic 在其第二份 186 页《风险报告》中披露,内部代号“Model 2”的模型总体能力略超 Claude Mythos 5,目前已大量用于编码、数据生成、研究与智能体任务,但公司明确表示“没有对外发布计划”。该模型在 CoBench v2 测试中得分为 62.8%,而 Mythos 5 为 50.3%,差距达 12.5 个百分点,不过距离 85% 的全自动替代研究员目标仍有差距。
已确认
- Model 2 能力:总体略优于 Mythos 5 (Claude 3.5 Sonnet),在内部代码和基础设施诊断任务中得分 62.8%。
- 部署状态:暂未完成完整的部署前评估,目前仅限内部使用。
- 性能对比:在 CoBench v2 测试中,Model 2 比 Mythos 5 高 12.5 个百分点。
尚未确认
- 架构推测:有观点称 Mythos Preview 可能是约 10T 参数的“教师”模型,Model 1 和 Model 2 是其迭代版本,Mythos 5 和 Fable 5 可能是蒸馏版本。
- 具体分数:内部 AECI 评估显示 Model 2 得分比 Mythos 5 高 1.5 分,预计约 162.79 分。
2026-08-15 ~ 2026-08-15 · 11 条相关
一手来源
- Anthropic 曝内部模型超 Mythos5,暂无发布计划 — 机器之心 ·
- 曝 Anthropic 内部模型能力显著提升,可替代部分技术员 — imjustnewatai ·
- Anthropic 报告曝光:内部 Model 2 能力略强于 Claude 3.5 — ChrisGPT ·
- Anthropic 高管确认 Mythos 5 为内部最强,提及神秘 Model 2 — scaling01 · 2026-08-15
- 传闻:Anthropic 内部使用远强于 Mythos 5 的模型 — kimmonismus · 2026-08-15
- 爆料:Mythos Preview 或为 10T 参数教师模型 — scaling01 · 2026-08-15
- 【源头】Anthropic 报告曝光:内部 Model 2 能力略强于 Claude 3.5 — ChrisGPT · 2026-08-15
- 爆料:Anthropic 内部模型在 CoBench 上超越 Mythos 5,接近替代研究员 — daniel_mac8 · 2026-08-15
- Anthropic内部模型评分曝光:新模型或已超Mythos 5 — scaling01 · 2026-08-15
- 未发布的 Model 2 得分62.8%,距全替代研究员仅差22.2% — ChrisGPT · 2026-08-15
- 【源头】曝 Anthropic 内部模型能力显著提升,可替代部分技术员 — imjustnewatai · 2026-08-15
- 爆料:Anthropic 内部有远超 Mythos 5 的模型未发布 — Neurogence · 2026-08-15
- 【源头】Anthropic 曝内部模型超 Mythos5,暂无发布计划 — 机器之心 · 2026-08-15
另有 1 条近重复转述:kimmonismus