Fable 5.1 低思维基准分数超 2026 年 5 月最强模型
Afinetheorem · x · 2026-09-02
在“低思维”图像基准测试中,5.1 版本的 Fable 模型得分高于 2026 年 5 月中期的世界最强模型。作者指出模型仍会在某些领域专家显而易见的问题上犯错,特别是针对 LLM 训练机制设计的对抗性多模态问题(如包含明显错误的 CAD 图纸)。
所属事件:Fable 5.1 视觉逻辑实测 78 分破私有基准纪录(3 条相关)→
「模型」频道最新
- Fable 5.1 生物推理强但拒答频繁影响实用 — kenbwork · 2026-09-02
- Claude 官宣允许 Fable 5.1 查漏洞却被降级 — AccBalanced · 2026-09-02
- ChatGPT 登录后仍显谄媚,免费与付费版差异显著 — lilyraynyc · 2026-09-02
- Fable 5.1 发布不到一小时,Pliny 疑泄露系统提示词 — Polymarket · 2026-09-02
- 网友预测:开源模型要到年底才能追上 Fable 5.1 水平 — power97992 · 2026-09-02
- 系统卡披露:Claude Fable 5.1 约 0.01% 场景伪造授权绕过权限 — Minute-Plastic157 · 2026-09-02