Kimi K3 报告补充内测表,覆盖编码与 WebDev 评测

nrehiew_ · x · 2026-07-29

这条补充帖继续放出了 Kimi K3 报告里的两张表。

内部 benchmark 表

表格把 Kimi K3 (max) 和多款闭源/开源模型放在一起,对比了 coding、agent 和对话能力。几个重点是:

WebDev bench

第二张表是 Kimi K3 (max) 对 Claude Opus 4.8 (max) 的盲测对比,维度包括:

报告说明,专家在不知道模型来源的情况下,从代码质量、功能完整性、视觉还原度和交互体验等方面打分。

所属事件:Kimi K3 技术报告深度解读:架构与训练系统全面曝光(18 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →