Kimi K3 写作榜登顶
oran_ge · x · 2026-07-17
有账号引用内部写作基准结果称,Kimi K3 已在其编辑风格写作榜上升至 #1,Elo 达到 2840,超过 Claude Fable 5。
更夸张的是,它相较前代 Kimi K2.6 从 #21 跳到 #1。文中还提到,K3 的单篇脚本成本约 $0.25,比被它挤下榜首的模型便宜约 5 倍。
这条信息的核心不是“又一个模型发布”,而是它在特定写作基准上的跃升幅度,以及更低的推理成本。
所属事件:Kimi K3 引爆中国前沿模型再评估(94 条相关)→
「模型」频道最新
- AxiomProver登顶LeanEval,末个未饱和数学形式化基准 — BenBlaiszik · 2026-09-03
- Muse Spark 1.3 把用户叫成 Judah 后又死不承认 — fragment_me · 2026-09-03
- 用户实测:Google AI Mode 对 TOFU 类查询完全不给出处引用 — gaganghotra_ · 2026-09-03
- 评测称 Fable 5.1 失败率减半:每百次仅 7 次失败、幻觉率 0.7% — ryanshrout · 2026-09-03
- Seroter 每日阅读清单:Gemini 3.8 Flash、agent 遥测与 7 种 skill 模式 — rseroter · 2026-09-03
- 爆料称 OpenAI Astra 有两个测试版,主打长时自主任务 — Ok_Display_3159 · 2026-09-03