模型评测:Astra 挑战 Fable 5.1,Terminal 4.0 胜负难分

ChrisGPT · x · 2026-09-02

围绕模型基准测试的讨论显示,Fable 5.1 在 Terminal bench 4.0 上表现强势。虽然 Astra 可能在除智能体科研基准外的其他测试中领先,但要在 Terminal bench 4.0 上击败 Fable 5.1 面临巨大挑战。这反映了当前模型在不同垂直基准测试中的性能差异。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →