三款编码模型盲测3D世界
MaziyarPanahi · x · 2026-07-18
对 Kimi K3、GLM-5.2 和 Opus 4.8 做了同题盲测:要求它们只用一个 HTML 文件和 three.js 写出完整 3D 世界,作者不手动改代码,由另一个盲审模型给每个渲染结果打分。
作者原本以为闭源模型会赢,但结果并不是;他还提到这个设置里三个模型都是“最强编码模型”级别,胜负完全取决于生成效果。
所属事件:Kimi K3 编程与3D推理惊艳亮相,实测击败多款SOTA(5 条相关)→
「编程与Agent」频道最新
- Anthropic 研究员:99% 工程师已跑 300+ 自改进 agent 群 — AlishaOutridge · 2026-09-11
- Gergely Orosz 观察:AI Agent 提速十倍交付,却带来一堆小退化 — ducha_aiki · 2026-09-11
- 同题 Echo Maze 实测:三大模型看似成功,代码里藏着同一个 bug — eyishazyer · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11
- Codex 用户实测:Sol 搭配 Astra/Luna 子代理更省额度 — pvncher · 2026-09-11
- 开源 Agent Skill 2.3k 星:生成 MVP 蓝图并审计重构 agentic harness — tom_doerr · 2026-09-11