Claude Fable 5.1 发布:八项评测全升但涨幅悬殊,价格最多降 45%
koltregaskes · x · 2026-09-03
Anthropic 发布 Claude Fable 5.1 与 Claude Mythos 5.1(同一模型、不同防护等级,后者仅面向可信访问计划,针对网安与生命科学场景)。关键信息:
- 提升不均匀:八项百分比评测全部上涨,但差距悬殊——智能体科学研究 +27.9 个百分点,而带工具的 Humanity's Last Exam 仅 +1.2 点。官方称其为编码与知识工作的最强模型,研究能力是 AI 推动科学进步的早期信号。
- 降价:典型负载下 token 计费价格比 Fable 5 便宜约 25%(主要来自 cache read 降价),高智能体负载场景最多省约 45%。
- Enterprise Frontier Safeguards (EFS):数据存放在客户自有云基础设施,实现等同零数据保留的完全隐私,同时保持防对抗使用的最先进防护,今秋起分阶段向企业开放;在此之前合资格客户可先用零数据保留。
- 误报改善:网安场景护栏误报减少 60%。
所属事件:Anthropic 发布 Claude Fable/Mythos 5.1,缓存降价 75%(102 条相关)→
「模型」频道最新
- Anthropic 上线 Claude 文件检测工具,C2PA 凭证一键验证出处 — btibor91 · 2026-09-03
- 字节开源 LoopLM:循环潜空间推理让 1.4B 模型比肩 12B 竞品,Bengio 参与 — peterjliu · 2026-09-03
- 小模型也能打:Gemini 3.8 Flash 一个 prompt 做出完整游戏 — ColbyHawker · 2026-09-03
- 用户晒图宣布退订 Claude,不满情绪引同行围观 — realmeetjames · 2026-09-03
- 一次 ultracode 会话烧掉 42% 周额度,用户怒斥 Anthropic 新模型 — BLUECOW009 · 2026-09-03
- Hamel Husain:提示词又回到「魔法咒语」时代 — HamelHusain · 2026-09-03