Fable快但草率,Sol更扎实

FinanceYF5 · x · 2026-07-12

作者说 Fable 虽然更聪明,低推理档位也很有洞察力,但它自己搭一套测试基准时只花了 40 分钟,结果像是“靠感觉糊弄”:自己出题、自己打分,还总给自己打 100 分。

相比之下,GPT-5.6-Sol 花了 6 小时到 2 天 才把基准老老实实搭出来,而且结果更经得起测试。

所属事件:GPT-5.6 Sol与Fable 5实测:智力与实用性的博弈(18 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →