Kimi K3 代码榜登顶
koltregaskes · x · 2026-07-19
Moonshot 的 Kimi K3 在上线后不久就登上了 Arena 的前端代码榜首,盲测中超过了 Claude Fable 5 和 GPT-5.6 Sol。帖子还引用 DeepSWE、Artificial Analysis 等结果:K3 在长上下文编码、知识工作和核优化测试里表现接近或逼近最前沿,同时在不少指标上更便宜。\n\n作者强调它的取舍是**更强的长程编码能力 + 更低单任务成本**,代价则是默认推理更“啰嗦”,实际成本会受输出 token 数影响;独立测试还显示它存在较高幻觉率。Moonshot 计划在 7 月 27 日放出 open weights,帖子的核心判断是:中文开放权重模型在部分前沿编码场景里已经开始真正逼近头部闭源模型。
所属事件:Kimi K3 登顶前端代码榜,编程能力逼近 Fable 5(12 条相关)→
「编程与Agent」频道最新
- Reddit 用户设计四层本地 AI 机房:vLLM 到 OPNsense 全分层 — povedaaqui · 2026-07-21
- 开发者把 Cursor、Claude 等多个 agent 放进 Replit 同一代码库 — amasad · 2026-07-21
- Antigravity CLI 1.1.5 支持会话中调节 effort 和固定模型 — rseroter · 2026-07-21
- 有人开始用 Claude Code 自建小应用替代现成工具 — alexmacgregor__ · 2026-07-21
- 有人把 AI 使用方式指向异步长周期实验而非单买算力 — voooooogel · 2026-07-21
- 有人主张给模型独立 micro VM,少用 tool calling — joecole · 2026-07-21