Kimi K3 多采样评测领先

zephyr_z9 · x · 2026-07-18

图中对比了 **Kimi K3** 和 **Fable 5** 在不同采样次数下的解题表现: - `pass@1`:Kimi K3 为 68.5,略低于 Fable 5 的 69.9。 - `pass@2`:Kimi K3 为 82.0,高于 Fable 5 的 80.2。 - `pass@4`:Kimi K3 为 89.4,高于 Fable 5 的 88.5。 这条转发想表达的是:Kimi K3 在多次采样设置下表现更强,甚至被称为“open/closed SOTA”。

所属事件:Kimi K3 登顶前端代码榜,编程能力逼近 Fable 5(12 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →