Qwen Image 2.1 对比 KREA 2 与 Minimax H3:姿势控制与提示词遵循实测
Divineboob · reddit · 2026-10-11
作者分享三家图像生成/编辑模型的实测对比,核心需求是用 VNCCS pose studio 控制多角色姿势并获得高提示词遵循度:
- Qwen Image 2.1(int8):画面电影感强、悦目;VNCCS 约 7/10 能准确控制身体姿势(头部不行)。缺点是模型僵硬,多角色交互时崩坏和幻觉明显多于 KREA。
- KREA 2(turbo 8 步 + wan 2.1 VAE):生成最快,T2I 提示词遵循度不加 LoRA 也优于 Qwen;但 ControlNet 工作流做多角色交互很痛苦,世界知识偏西方,非西方人种表现差。
- Minimax H3:提示词遵循度最佳(基于 qwen3vl 32b),配合 VNCCS pose studio 效果好;但生成时间翻倍,角色质感偏「橡胶感」。
作者还提到 flux2 Klein 配 VNCCS 表现不如预期且更慢,仍在寻找兼顾姿势控制、遵循度与真实皮肤质感的方案。
「多模态」频道最新
- WIRED 实测 Google Playground:一天做出三款「不好玩但能玩」的 AI 游戏 — nordicinst · 2026-10-11
- 极简黑白水墨人像 prompt 分享:一笔一线画出生活瞬间 — azed_ai · 2026-10-11
- Midjourney sref 风格码实测:机械鲸飞越沙漠全参数示例 — michaelrabone · 2026-10-11
- 用 Qwen 写视频提示词后,创作者称效果反超闭源大模型 — Turbulent_Blood5886 · 2026-10-11
- Reddit 用户实测 3D 生成:效果居然真能用 — vibribbon · 2026-10-11
- Midjourney 搭配 NB 2.1 生成地铁站氛围感新作品 — gizakdag · 2026-10-11