横评 33 个 Qwen 模型:千次生成结果直观对比
kms_dev · reddit · 2026-08-03
一位开发者周末在 OpenRouter 上测试了所有最便宜的模型,并对 33 个不同的 Qwen 模型进行了横评。
- 测试规模:使用 35 个不同的提示词进行单次生成测试,最终成功收集了 1109 个有效输出结果。
- 覆盖版本:涵盖了从 Qwen 2.5 到最新的 Qwen 3.7,以及 Coder、VL(视觉语言)等多个细分版本和参数量大小的模型。
- 查看方式:开发者将所有结果汇总在 OneshotLM 网站上,方便用户直观对比不同参数和版本模型在相同提示词下的实际生成质量。
「模型」频道最新
- 相同 Prompt 消耗 10 倍 Token,开发者吐槽 OpenAI 模型开销 — michael_g_williams · 2026-08-03
- Kimi K3 深度技术解析:2.78万亿参数架构与训练机制 — imrancoder · 2026-08-03
- 测试框架决定模型成绩:DeepSeek V4 Flash 实测引争议 — PMinervini · 2026-08-03
- 曝智谱 GLM 5.5 与 DeepSeek Pro 将于 8 月发布 — bindureddy · 2026-08-03
- MiniMax H3 多模态视频模型即将登陆 ComfyUI — NerdyRodent · 2026-08-03
- OpenAI 预付费 API 额度一年过期,开发者吐槽:钱也有保质期? — mark_k · 2026-08-03