Claude Fable 5.1达SimpleBench 86.6%,首超人类基线
Profanion · reddit · 2026-09-03
Reddit 用户分享 SimpleBench 评测成绩:
- Claude Fable 5.1:86.6%
- 人类基线:83.7%
- Gemini 3.8 Flash:82.4%
- Claude Fable:81.9%
- Muse Spark 1.3:81.8%
Claude Fable 5.1 超过人类平均基线,位列第一。
「模型」频道最新
- OpenEvidence 发布医疗模型家族,Darwin 以 MedQA 满分创历史 — benxneo · 2026-09-03
- 数据:开源权重模型已在全球生产环境广泛落地,成本并非首因 — perilli · 2026-09-03
- Claude、Codex、ChatGPT 齐宕机,网友疑惑 major providers 为何全挂 — basedjensen · 2026-09-03
- ChatGPT 今日大面积宕机,多家 AI 服务同时不可用 — Abhishekcur · 2026-09-03
- 主流大模型集体宕机,本地模型玩家终于扬眉吐气 — zeeg · 2026-09-03
- Open Athena 开训 535B MoE 模型 Marin:18T tokens 全程公开 — TheTuringPost · 2026-09-03