Kimi K3 与 Opus 5 对比:任务质量接近,K3 成本低 2-4.6 倍
lqiao · x · 2026-07-28
Fireworks AI 的 lqiao 发布了对 Kimi K3 和 Opus 5 的对比研究,基于 SWE(480)、Algorithmic(100)、Terminal(83)三个基准测试。任务级质量上 Opus 5 持平或略优,但 K3 的每任务成本(基于无服务器定价)便宜 2 到 4.6 倍。研究强调按任务成本而非 token 成本衡量,因为开源模型通常更冗长。Fireworks 计划通过推理优化和训练提升效率与质量。
所属事件:实测显示 Kimi K3 质量媲美 Opus 5 且成本大幅降低(4 条相关)→
「模型」频道最新
- 传闻称 Anthropic 有更大的内部教师模型,公开版也接近 K3 — teortaxesTex · 2026-07-28
- Kimi 报告披露覆盖编程与 Agent 的内部评测体系 — stochasticchasm · 2026-07-28
- Claude 仍被称为最可控的模型集,尽管它很怪 — sloppenheimer · 2026-07-28
- 前端代码 Arena 榜单:Opus 5 Max 居首,Kimi K3 Max 紧随其后 — arena · 2026-07-28
- Kimi K3 Max 登顶 Arena 榜首,前端与 Agent 任务全面领先 — arena · 2026-07-28
- Kimi K3 上线 Hugging Face 推理 API,输出价格 15 美元/百万 tokens — mervenoyann · 2026-07-28