读规格书发现:Krea 2 图像模型两端都是 Qwen 组件
Even_Package_8573 · reddit · 2026-09-24
- 作者不满足于各家晒的样张网格,直接读了 Krea 2 的规格说明,发现其骨干虽是从头训练,但真正干活的两个部件都来自 Qwen:文本编码器是 Qwen3-VL 4B,且不像常见做法只取最后隐状态,而是每个 token 取 12 层解码器输出在 transformer 内融合;图像端则是 Qwen-Image VAE 负责从 latent 还原图像。
- 因此懂 Qwen-Image 的文本与构图行为,基本就懂了 Krea 2 的表现来源。
- 关于 Raw/Turbo 两种权重的澄清:Raw 不是「无审查」版本,而是未蒸馏的中期训练 checkpoint,用于微调和 LoRA 训练,需 28 步、CFG 4.5,约 26GB(diffusers 安装);Turbo 是生成用版本,8 步、无 guidance。抱怨它「太重」的人多是拿训练底模去出图。
- 推荐用法:用 Raw 配五六十张小数据集训 LoRA,再用 Turbo 出图;只想生成图片可直接用量化版 Turbo。
「模型」频道最新
- Matt Shumer:新模型就像新入职员工,得重新磨合脾气 — mattshumer_ · 2026-09-25
- Opus 5.5 默认版更谄媚?观察者归因于「所有权感」缺失 — Sauers_ · 2026-09-25
- 开着自动充值睡觉,Codex 一夜连环扣费被银行当成诈骗拦截 — CtrlAltDwayne · 2026-09-25
- Dietterich 澄清 LLM 不只是「预测下一个词」 — tdietterich · 2026-09-25
- DeepSeek 中秋发图暗示新动态,网友猜测 V4 将于近期发布 — teortaxesTex · 2026-09-25
- NaceAI 发布 6B 参数小模型 Drex,登顶决策指数榜 — ordax · 2026-09-25