K3 或冲进 WeirdML 前十,作者给出 75%–83% 预测
teortaxesTex · x · 2026-07-28
帖子在讨论 K3 在 WeirdML 上的表现预测,并提到哈佛有一项政策:不测试来自中国的模型,因此只剩两周窗口来判断它的实力。
作者基于 GLM 的既有轨迹判断,K3 有可能进入榜单 Top 10,并给出一个大致区间:在不同设置下大约会落在 75%–83%。
所属事件:K3 在 WeirdML 榜单表现预测引发关注(2 条相关)→
「模型」频道最新
- Kimi 报告披露覆盖编程与 Agent 的内部评测体系 — stochasticchasm · 2026-07-28
- Claude 仍被称为最可控的模型集,尽管它很怪 — sloppenheimer · 2026-07-28
- 前端代码 Arena 榜单:Opus 5 Max 居首,Kimi K3 Max 紧随其后 — arena · 2026-07-28
- Kimi K3 Max 登顶 Arena 榜首,前端与 Agent 任务全面领先 — arena · 2026-07-28
- Kimi K3 上线 Hugging Face 推理 API,输出价格 15 美元/百万 tokens — mervenoyann · 2026-07-28
- OpenRouter 将 GPT-5.6 Terra 和 Luna 价格砍半 — OpenAIDevs · 2026-07-28