Qwen 与 GLM 模型代码生成复现实测对比
nomorebuttsplz · reddit · 2026-08-30
作者对 Qwen 3.8 Flash Next 和 GLM 5.3 Flash 进行了非科学对比,任务是复现参考图并将其转化为“游戏或 Tech Demo”。结果显示:
- GLM Flash:在视觉还原度上表现更好,选择 Canvas 2D 方案,能根据指令持续迭代,最终生成了一个可玩的像素艺术步行模拟器,未表现出停止迭代的迹象。
- Qwen:选择从零编写软件渲染器,10 分钟生成了动画像素城市,但在理解“持续优化直至无法改进”指令上表现不佳,容易过早停止;在另一轮运行中虽迭代 80 分钟,但视觉还原度仍不如 GLM。
结论:GLM 在指令遵循(尤其是视觉还原)上略胜一筹,Qwen 则在快速生成动画城市上有亮点。
「编程与Agent」频道最新
- Grok Bot 接入特斯拉 Sentry 自动剪辑视频并完成保险报案 — xiaosun86 · 2026-08-30
- 实测 Grok Bot 接管 Cloudflare:慢但真的能干活 — tristanbob · 2026-08-30
- 观点:智能体使用神经语言通信效果很差 — _arohan_ · 2026-08-30
- MCP Europe Tools 发布:AI Agent 欧洲数据验证工具 — modelcontextprotocol · 2026-08-30
- 手把手教你用 Hermes 和 OpenClaw 搭建公司级 Agent OS — aakashgupta · 2026-08-30
- GitHub 热门:集成 35 种生产级 Agent 架构的开源库 — tom_doerr · 2026-08-30