Kimi K3 与 Fable 评测高度一致
ZainHasan6 · x · 2026-07-18
作者给出 Kimi K3 与 Fable 的逐任务一致性统计:两者相关系数达到 **0.72**,是已见过的最高跨厂商相似度。 图中还显示: - `both 96`,即两者都通过的任务很多 - `Kimi-only 5`、`Fable-only 4`、`neither 8` - 没有出现“一方 4/4 另一方 0/4”的极端分歧 作者因此判断:这个 benchmark 可能已经接近饱和。
所属事件:Kimi K3 登顶前端代码榜,编程能力逼近 Fable 5(12 条相关)→
「模型」频道最新
- 有人称 OpenAI 和 Anthropic 抱怨中国开源权重模型很荒谬 — krishnan · 2026-07-21
- PrismML Bonsai 27B 量化后仅 3.8GB 可手机运行 — tony10000 · 2026-07-21
- actAVA AI 推出 1T 参数医疗代理模型 Cura — _akhaliq · 2026-07-21
- 有人觉得 Claude Fable 出现了更像 Gemini 的僵硬感 — teortaxesTex · 2026-07-21
- Reddit 实测:z.ai 上的 GLM-5.2 确实能网页搜索 — Umr_at_Tawil · 2026-07-21
- Kimi CEO 称 token 效率才是 Kimi 3 的新优势 — HowDevelop · 2026-07-21