Reddit 用户吐槽 Qwen 2.1 图像生成数字能力差
SSj_Enforcer · reddit · 2026-09-24
一位 Reddit 用户抱怨 Qwen 2.1 在数字控制方面表现糟糕:尝试了十几个 prompt 都无法生成「嘴里三盏灯」的图,而 Flux Klein 2 几乎每次都能一次成功。帖子引发对开源图像模型数字渲染能力的讨论。
「多模态」频道最新
- MiniMax-H3 上 AMD MI355X:视频生成提速 26.7 倍,5 秒片 1.3 秒出 — junyanz89 · 2026-09-24
- RecCAR 正则化弥合联合视频生成的跨模态注意力差距 — barilan · 2026-09-24
- ComfyUI Prompt Composer 更新:支持 RefMod 与 LoRA 的可视化提示词编排 — Francky_B · 2026-09-24
- 双 H200 微调 Marigold V2 加 16 帧时序注意力,攻克视频深度闪烁 — AntonObukhov1 · 2026-09-24
- Grok 4.7 搭配 Blender 建 3D 模型,马斯克转发称质量提升巨大 — elonmusk · 2026-09-24
- Midjourney v8.2 实测:红外胶片风超现实晨间人像提示词 — tisch_eins · 2026-09-24