实测者称 Fable 5.1 视觉+逻辑登顶,私测逻辑基准 78 分破纪录
Afinetheorem · x · 2026-09-02
独立实测者对 Fable 5.1 的简评:写作风格仍是很浓的「Claude 味」;它是首个在视觉+逻辑基准上接近榜首的非 Gemini 模型;在其为另一家实验室编写的私有逻辑基准上拿到 78 分,大幅超过此前最高分——Sol 5.6 Pro 的 61 分。
所属事件:Fable 5.1 视觉逻辑实测 78 分破私有基准纪录(3 条相关)→
「模型」频道最新
- OpenAI 发布网络安全模型 Astra,达关键级阈值 — OpenAI · 2026-09-02
- 观察:AI 语音模式下回复变简洁,适应人类倾听习惯 — joshwhiton · 2026-09-02
- Anthropic 被指回溯为旧版 Opus 模型加强防护 — LordCoice · 2026-09-02
- 泄露显示 Claude.ai 系统指令长度已达 13.8 万 token — frubberism · 2026-09-02
- 实测 Fable 5.1 生成成本超 GPT-5.6 六倍,细节更丰富 — rohanpaul_ai · 2026-09-02
- 实测 Fable 5.1 贵 6 倍:画质更细腻但仍犯低级错误 — rohanpaul_ai · 2026-09-02