Fable 5.1 编程评分超 Opus 5
firstadopter · x · 2026-09-02
在 Terminal-Bench 4.0 测试中,Fable 5.1 得分 55.8%,超过 Fable 5 的 42% 和 Opus 5 的 52.3%。它在 Agent 编程和计算机使用评估中也表现领先。
所属事件:Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1,基准提升且缓存降价75%(58 条相关)→
「编程与Agent」频道最新
- 新书推荐:从设计模式到生产级 AI Agent — JordiRib1 · 2026-09-02
- Grok Bot 彻底消灭手动数据录入,效率惊人 — djcows · 2026-09-02
- Claude Code 几分钟生成树莓派外壳代码 — shekitup · 2026-09-02
- Prime Agent 为何选 RLM 轨迹训练而非提示词调优 — CShorten30 · 2026-09-02
- Rohan Paul:Vibe coding 时代更应依赖 Auth0 等成熟基础设施 — rohanpaul_ai · 2026-09-02
- Kernel 为 Agent 访问互联网重写 Go 代理,唤醒提速 92% — ycombinator · 2026-09-02