Kimi K3 对比 Fable 5 评测
ZainHasan6 · x · 2026-07-18
一条基于 DeepSWE 的软件工程评测讨论,比较了 Kimi K3 和 Claude Fable 5 的表现。
要点是:
- 评测结果显示,Kimi K3 在软件工程任务上能达到与 Fable 5 接近的性能。
- 在价格上,Kimi K3 约为 Fable 5 的 35%。
- 在更高的 pass@k 设定下,Kimi K3 还表现出一定优势。
原帖的结论是:开源/前沿模型和闭源前沿模型之间的差距,似乎已经不再是“落后六个月”那么简单。
所属事件:Kimi K3 登顶前端代码榜,编程能力逼近 Fable 5(12 条相关)→
「模型」频道最新
- 传 OpenAI 在 Astra 中使用 neuralese 循环变换器,新的 scaling 轴浮出水面 — imadade · 2026-09-03
- XBOW 团队拿下今年首个 Chrome 全链漏洞利用奖励 — moyix · 2026-09-03
- Gemini 3.8 Flash 的 Pareto 最优地位仅维持了 5 小时 18 分钟 — alejandroll10 · 2026-09-03
- 双 DGX Spark 实测:GLM-5.3-Flash 写作与视觉胜过 DeepSeek-V4-Flash — kuhunaxeyive · 2026-09-03
- Anthropic 商务智能体只建购物车交人工结账,被赞退款风控思路对 — HaktanSuren · 2026-09-03
- Qwen3.8 27B Q8 翻车:12 万 token 后发现根本没读计划,自行实现别的功能 — KingCpzombie · 2026-09-03