Kimi K3 编程与3D推理惊艳亮相,实测击败多款SOTA

近期,Kimi K3 模型在编程、3D 推理及 Agent 能力上展现出极其优异的表现,引发了技术圈的高度关注与热烈讨论。不仅在多项严苛的横向评测中击败了当前的主流 SOTA 模型,其展现出的空间智能潜力更让业界对其在具身智能等物理世界交互场景的应用充满期待。

盲测与实测表现

在 3D 渲染与代码生成的盲测中,Kimi K3 展现了统治级的表现。据 @MaziyarPanahi 的测试,在要求仅用单个 HTML 文件和 three.js 生成完整 3D 世界的任务里,Kimi K3 击败了 GLM-5.2 和 Opus 4.8。测试过程由盲评模型 Qwen3-VL 在不知晓模型出处的情况下打分,K3 的渲染效果胜出。此外,@karminski3 对 K3 进行了全方位编程实测,指出其迅速淘汰了前端测试集,后端向量数据库测试也仅剩少数未通过,整体编程与 Agent 能力均属顶尖梯队。

空间智能与行业反响

K3 的强大 3D 构建能力不仅限于 voxel art,@DeryaTR_ 认为这种“空间智能”上升到认知基础层面,与世界模型、具身智能及机器人理解物理世界的方向高度契合。由于模型表现过于惊艳,技术从业者 @_xjdr 在体验后给出了极高评价,并强烈呼吁获取模型权重,以便在自有推理栈上进行本地部署。

2026-07-18 ~ 2026-07-20 · 5 条相关