SimpleBench 结果:Kimi-K3 表现诡异,Grok 4.6 领跑

scaling01 · x · 2026-08-16

SimpleBench 评测结果显示,Kimi-K3 和 Qwen3.8 2.4T 的表现非常奇怪,而 Grok 4.6 和 Muse Spark 1.2 则表现出色。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →