Kimi K3 盲测赢了代码渲染
MaziyarPanahi · x · 2026-07-18
对 Kimi K3、GLM-5.2、Opus 4.8 做了一次同题盲测:要求它们用 单个 HTML 文件、只用 three.js 生成完整 3D 世界,并由一个 盲评的 Qwen3-VL 按渲染效果打分,评分时不知道对应模型。
结果是 Kimi K3 拿到第一,多个世界里都名列前茅;Opus 4.8 紧随其后,并在“翡翠城”场景中胜出;GLM-5.2 排第三,但每个世界都保持了结构稳定、没有崩坏。作者特别提到,Kimi K3 的开权重要到 7 月 27 日 才发布,但它在这类创意渲染任务上已经能压过闭源前沿模型。
所属事件:Kimi K3 编程与3D推理惊艳亮相,实测击败多款SOTA(5 条相关)→
「模型」频道最新
- 传 OpenAI 在 Astra 中使用 neuralese 循环变换器,新的 scaling 轴浮出水面 — imadade · 2026-09-03
- XBOW 团队拿下今年首个 Chrome 全链漏洞利用奖励 — moyix · 2026-09-03
- Gemini 3.8 Flash 的 Pareto 最优地位仅维持了 5 小时 18 分钟 — alejandroll10 · 2026-09-03
- 双 DGX Spark 实测:GLM-5.3-Flash 写作与视觉胜过 DeepSeek-V4-Flash — kuhunaxeyive · 2026-09-03
- Anthropic 商务智能体只建购物车交人工结账,被赞退款风控思路对 — HaktanSuren · 2026-09-03
- Qwen3.8 27B Q8 翻车:12 万 token 后发现根本没读计划,自行实现别的功能 — KingCpzombie · 2026-09-03