Anthropic 发布 Claude Fable/Mythos 5.1:新 SOTA 但任务成本涨 20%
Latent Space · rss · 2026-09-02
Anthropic 发布了新的旗舰模型 Claude Fable 5.1(编码与长程任务)和 Mythos 5.1(知识工作),宣称其为“世界最先进的模型”。
核心更新与数据
- 性能表现:在 Artificial Analysis 智力指数中达到 66 分,超越 Opus 5 (63) 和 Fable 5 (62);Terminal-Bench Science 提升 2 倍多(24.7% → 52.6%)。
- 定价策略:输入/输出/缓存写入价格维持不变($10/$50/$12.5),但缓存读取价格大幅下调 75%(降至 $0.25/MTok),利好长上下文 Agent。
- 成本争议:虽然缓存便宜了,但模型输出量增加约 1.7 倍,导致单任务总成本反而上涨约 20%($3.14 → $3.76)。GPT-5.6 Sol 在性价比上仍具优势。
技术细节与争议
- 架构猜测:社区分析认为 Fable 5.1 和 Mythos 5.1 可能基于同一套底层权重,仅通过安全分类器和路由行为区分,而非完全不同的基础模型。
- 回退机制:评测中发现约 4% 的 token 因安全触发被路由回 Opus 4.8/5,引发了关于“真实能力”的讨论。
- Agent 定位:官方强调 Fable 5.1 针对自主、多步的长时间任务,并引入了 Enterprise Frontier Safeguards (EFS) 等企业级控制。
「编程与Agent」频道最新
- LLM拒破DRM后,agent改用截屏+OCR组合翻译《三体》 — evisoft · 2026-09-02
- Fable 5.1 20 分钟构建 macOS 动画设计应用 — amos_gyamfi · 2026-09-02
- 实测 AI Agent 测试工具:补充而非替代传统脚本 — PartyVermicelli1870 · 2026-09-02
- 尝试用 Claude 复活 streamlit-drawable-canvas 项目 — andfanilo · 2026-09-02
- 给 AI Agent 配套独立基础设施,开发者会买单吗? — Athlore_AI · 2026-09-02
- 开发决策只记结果不记理由,这合理吗? — Sea-Perception1619 · 2026-09-02