Anthropic 内部 AECI 指数:下一代模型提升极小
ChrisGPT · x · 2026-08-21
Anthropic 在展示中意外透露了下一代模型在其内部能力指数(AECI)上的表现。AECI 是 Anthropic 基于 Epoch 能力指数改编的内部基准,综合了多项测试结果。数据显示,Mythos 5 的 AECI 评分约为 161 分,而即将发布的 Model 2 仅高出 1.5 分(约 162.5 - 163 分),误差范围较大。不过,在 CoBench 基准上两者差距显著,暗示 Anthropic 目前的重点在于提升内部研究能力,而非广泛的通用能力指标。
「模型」频道最新
- 开发者警告:无审查Qwen 3.8 27B模型在Mac上直接教人制毒 — Polymarket · 2026-08-21
- 给编辑器加 Mermaid 功能,竟成模型能力试金石 — oran_ge · 2026-08-21
- Liquid AI 发布 DSpark 草稿模型,推理提速 3 倍 — JosephJacks_ · 2026-08-21
- 观点:Anthropic 新一代模型中,Fable 5 体验最佳 — bindureddy · 2026-08-21
- 自回归模型也可用于图像生成,无需扩散模型 — cloneofsimo · 2026-08-21
- 评 GeneralistAI 演示:行为提示缺 OOD 泛化证据 — chris_j_paxton · 2026-08-21