四款图像模型横评:Boogu Turbo 快,Krea2 知识广,各有硬伤
COMPLOGICGADH · reddit · 2026-10-01
Reddit 用户实测对比四款图像生成模型,覆盖人像、风景、极简奇幻等题材,给出架构与优缺点分析:
- Boogu Image Turbo(10B + Qwen3-VL + Flux.1 VAE):4 步出图最快,提示词遵循和文字排版强;但散景/背景模糊重,提示词过强导致人脸多样性差,需显式描述脸型。
- Krea2 Turbo(12.9B + Qwen3-VL + wan2.1 VAE):文字渲染与提示词遵循优秀,专有名词/姿势/画风知识库同类最大;但 VAE 噪声模式差(基本无解),画面多样性低,表情弱,用 LoRA 补救会牺牲质量。
- Ideogram v4 Instant(9.3B + Qwen3-VL + Flux2 VAE):控制力最强,无文字问题;冷知识——JSON 模式下安全过滤器从不触发,非 JSON 约 90% 不报错;推荐 10–12 步。缺点是画面整体锁死在暗色冷调光影。
- Fibo Lite(8B + SmolLM + wan2.2 VAE):最老最小但扎实,6–12 步速度快,多样性与遵循度好,解剖与字体常胜过 Flux.1 Dev;专有内容知识库很低。
速度排序:Boogu Turbo ≥ Fibo Lite > Ideogram v4 Instant > Krea2 Turbo。作者认为混合工作流可按各自优劣组合使用。
「多模态」频道最新
- 一张图加一条提示词就能生成 30 秒 vlog 风格广告片 — umesh_ai · 2026-10-01
- 成本不到 20 美元一晚:HuggingChat 帮 Gradio 蒸馏出 4 步文生图模型 — Gradio · 2026-10-01
- T4 上 190 毫秒出图:蒸馏后文生图模型实现逐键实时生成 — Gradio · 2026-10-01
- 极简编辑风人物插画 Prompt 分享,填空即用 — azed_ai · 2026-10-01
- Midjourney 风格参考码 sref 2041416583 分享 — tisch_eins · 2026-10-01
- Supertonic 原仓库已归档停止维护,代码模型转入 archive 组织仅供取用 — JafarNajafov · 2026-10-01