Qwen3-VL-4B 已能按 prompt 出图:ostrisai 混合图像模型首批样张公布
ostrisai · x · 2026-09-20
ostrisai 公布其 AR/扩散混合图像模型(Qwen3-VL-4B 自回归 + 冻结 BFL Klein 4B 扩散解码器)使用 AI Toolkit 默认 prompt 生成的首批样张,显示 AR 模型已明显理解如何根据 prompt 生成匹配的图像。
所属事件:AI Toolkit 作者单卡 24 小时训出 AR+扩散混合图像模型(4 条相关)→
「多模态」频道最新
- 30 秒一镜到底手机实拍感视频 prompt 流传:关键在真实起始帧 — techhalla · 2026-09-20
- 用 MiniMax H3 生成《EVA:终》× Arby's 儿童餐联动恶搞视频 — Certain_Potato_4509 · 2026-09-20
- 用户实测 Seedance 2.5:什么怪点子都能实现,就是贵得离谱 — flowersslop · 2026-09-20
- 开源 ACE-Step UI 本地免费生成完整歌曲,替代 Suno 每月 10-30 美元订阅 — cocktailpeanut · 2026-09-20
- 用 Qwen3.8 配 YuE2 写歌词,AI 音乐创作全流程分享 — cocktailpeanut · 2026-09-20
- Reddit 用户开源角色一致性 Prompt 生成器,面向 AI 图像创作 — Nefilim_666 · 2026-09-20