Fable 5.1 评测:估算能力依然糟糕

rudrank · x · 2026-09-02

用户反馈称 Fable 5.1 在估算(Estimates)任务上的表现依然很差,暗示该模型在数值推理或特定任务能力上存在明显缺陷。

所属事件:Fable 5.1 逻辑基准 78 分破纪录,估算能力仍弱(4 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →