Reddit 实测四款模型 Three.js 编码挑战,Grok 4.5 居首
EarlyBuilder_529 · reddit · 2026-07-25
Reddit 作者用同一条 Three.js 真实编码提示词,对 Grok 4.5、Qwen 3.8 Max、GLM 5.2、GPT 5.3 Codex,后来还包括 Claude Sonnet 5,做了一次“AI Coding Battle”。评测维度包括视觉效果、提示词理解、动画流畅度、工程实现、代码质量和整体体验。
- 题目:生成一个单文件 HTML 页面,用 Three.js 渲染可旋转地球、陨石撞击、爆炸闪光,以及 300+ 碎片粒子。
- 结果:作者把 Grok 4.5 排第一,认为它的动画最顺、电影感最强。
- 惊喜:Qwen 3.8 Max 排第二,被评价为“最大的惊喜”,实现很精致。
- GLM 5.2 粒子和视觉表现也不错;GPT 5.3 Codex 工程质量干净,但在这类图形任务里只排第四。
- 作者强调这只是一次特定图形任务的结果,不代表所有任务;后续会继续做这个系列。
「编程与Agent」频道最新
- OpenAI 推出企业 agent 产品 Presence,可自动解决 75% 客服问题 — dl_weekly · 2026-07-25
- 浏览器智能体基准测试:diff 记忆让 token 增长降 37% — Desperate_Title1595 · 2026-07-25
- Hermes 通过持久记忆和技能生成走向自我进化 — Teknium · 2026-07-25
- Cass 想统一搜索 Claude Code 等多种会话记录 — doodlestein · 2026-07-25
- Forge Neo 扩展接入 Krea 2 Identity Edit,复现图像身份编辑 — adeliogentile · 2026-07-25
- GlobalGPT 推出 CLI,把 Skills 和 MCP 接入 Codex — HeyAmit_ · 2026-07-25