单张参考图锁定人物形象:新版图像模型实测文字与信息图也稳
techhalla · x · 2026-10-09
设计博主 @techhalla 实测新版图像生成模型:只需喂一张本人参考图,无论换成木刻版画、像素风、 boxed 人偶包装盒还是完整信息图,每次生成都保持高度一致的人物形象,皱纹等面部细节真实。
亮点包括:文字一次拼写正确、可实际阅读的信息图、plain text-to-image 能准确命中指定风格而非模型「自选」风格;draft 模式每次跑 16 张草图,快速锁定方向后再精修最终稿。作者还公开了包含 100+ 提示词的 space 供直接取用。
所属事件:RL 推导系列与斯坦福 AA203 十九讲深度复盘(4 条相关)→
「多模态」频道最新
- Higgsfield 把爆红 AI 网红凑成短剧,AI Influencer 工具再出新玩法 — SimplyAnnisa · 2026-10-09
- 首部全 AI 生成电影《Gods Don't Give Gifts》获 MPA 官方分级,将冲击奥斯卡 — Polymarket · 2026-10-09
- Google×Unity 推 AI 游戏乐园:文字生成游戏,另出 Spark 打磨原型 — glenbeer · 2026-10-09
- Hugging Face Speech-to-Speech 新增波斯语 ASR 与 TTS — andimarafioti · 2026-10-09
- ComfyUI 应用 ANIMA 走红:让 Qwen 3.5「幻觉」改写热图获 30 万浏览 — Ok_Contribution8157 · 2026-10-09
- NeurIPS 2026 论文 NAMVIS:next-scale 自回归替代扩散,新视角合成提速 3 倍 — RexDouglass · 2026-10-09