Kimi K3 成首个通过 Compound 内部基准的开源模型

peterjliu · x · 2026-07-29

Compound 团队分享了他们在多模型编排系统中的最新测试结果。该团队通过协调器 agent 和子 agent 组合不同模型的优势,以达到单一模型无法实现的帕累托最优。

在针对内部专属“检查清单”基准的长期测试中,此前只有近期的 Claude 模型能稳定通过,Gemini 基本无法完成,OpenAI 直到 Sol 5.6 版本才通过。最新测试表明,月之暗面的 Kimi K3 成为首个顺利通过该基准测试的开源模型。

所属事件:Kimi K3 通过 Compound 基准但缓存命中率被指拖累成本(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →