Kimi K3 与 Fable 5 的差距已不像过去那样明显
FinanceYF5 · x · 2026-07-21
这条帖把 Kimi K3 与 Fable 5 在软件工程 / DeepSWE 任务上的表现拿来做更深入的对比,并直接给出判断:前沿开源模型已经不再落后 6 个月。配图是两者的对照卡:Kimi K3 标注为 开源,Fable 5 标注为 闭源。
结合前后文的结果,Kimi K3 在这类 best-of-k 编程任务上已经能和顶级闭源模型正面竞争,分数差距不大,而且不同厂商模型的失败模式也越来越相似。
所属事件:Kimi K3 软件任务评测紧咬 Fable 5,开源追平闭源(6 条相关)→
「模型」频道最新
- 转发称开源实验室可蒸馏出 32GB 显存级 SOTA 模型 — bookwormengr · 2026-07-21
- Moonshot 因 GPU 需求暴涨暂停 Kimi K3 新注册 — eyishazyer · 2026-07-21
- AI 版《Diplomacy》让智能体谈判结盟又互相背刺 — jamdac · 2026-07-21
- 更强模型需要新的提示方式,旧技巧反而可能拖后腿 — emollick · 2026-07-21
- GLM-5.5 被传 4 周内发布并开放权重 — tanay_mehta · 2026-07-21
- Fable 5 被称找到 Jacobian 猜想的三变量反例 — Various-Affect4841 · 2026-07-21