开源模型 ox-alpha 评测接近 Grok,效率亮眼

zainhas · x · 2026-08-22

开源模型 ox-alpha 在 DeepSWE 评测子集上取得了 63% 的成绩,平均输出 tokens 达 4.7 万。这使其在开源模型中达到帕累托最优,并接近闭源模型 Grok 4.6 的水平。评测者指出,该模型 extrapolates 到 dsv4 pro 级别的模型能力,但具备类似 GPT-5.6 的 token 效率。

所属事件:开源模型 ox-alpha 实测成绩曝光,接近顶级闭源模型(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →