Kimi K3 与 Fable 编程对比
ssh4net · x · 2026-07-19
在 Cline 的真实 bug 上做了同一套 harness 对比:**Kimi K3** 和 **Fable 5** 都能修复问题,但各有侧重。 - **Fable 5 更快**:总耗时 **3.5 分钟**、**18** 次工具调用;Kimi K3 为 **12 分钟**、**34** 次工具调用。 - **Kimi K3 更省钱**:用掉 **1.2M** tokens,花费 **$0.92**;Fable 5 用 **730K** tokens,花费 **$2.13**。 - 作者认为,轨迹显示 Kimi 更像经过强化学习训练,会花更多 token 做思考与验证。 - 结论是:这是他们第一次看到一个**开源权重模型**在真实 coding-agent 场景里与 SOTA 正面竞争。
所属事件:Kimi K3 评测成绩两极分化,工具链影响显著(5 条相关)→
「编程与Agent」频道最新
- Insight Partners 画出拥挤的 AI 自动化与 Agent 版图 — n_sri_laasya · 2026-07-21
- 路由故障让 Claude Code 智能体 3.5 小时烧掉 3020 万 token — RileyRalmuto · 2026-07-21
- 整理 Codex 反复使用的代码与认知术语 — alexisgallagher · 2026-07-21
- 一个 Rust TUI 项目用 Unicode 近似渲染 LaTeX — doodlestein · 2026-07-21
- Claude Code 和 Codex 还在照搬终端历史键逻辑 — ZeroStateReflex · 2026-07-21
- 8.6K 星开源手册梳理自治 AI 系统工程栈 — goyalshaliniuk · 2026-07-21