ComfyUI Photoshoot 节点:一次描述生成多角度多姿态人物照
neonralksta · reddit · 2026-08-24
作者发布了一个 ComfyUI 自定义节点“Photoshoot”,旨在解决生成同一个人不同构图/姿态/情绪的连续照片时 prompt 不一致的问题。
核心功能:
- Person Builder:通过 44 个字段(身体、面部、发型、妆容、服装等)结构化描述人物,支持保存并在下次会话复用。
- Photoshoot:基于设定的人物,自动生成一系列图片。支持 6 个维度的排列组合:摄像机(7 种取景)、姿态(18 种)、表情(90 种情绪)、焦距、比例和噪点。
技术洞察与踩坑:
- Token 权重问题:广角镜头必须精简 prompt,否则模型会按 token 权重分配画面,导致头部占据过半画面。
- 确定性生成:采用组合遍历而非随机采样,保证系列不重复且可复现扩展。
- 指令冲突:独立的参数轴可能产生逻辑冲突(如“特写”+“远景”),导致画面出现双重人影,需要代码层面耦合约束。
该节点基于 Krea 2 测量,但输出仅为文本 prompt,适配 Flux/SD 3.5/Qwen-Image 等 T5/LLM 编码器模型(SD 1.5/XXL 可能因 77 token 限制截断)。
「多模态」频道最新
- 实测 Wan 2.2 精炼 Minimax 视频:消除涂抹并支持自定义 LoRA — GrungeWerX · 2026-08-24
- 音乐黑客为何看重 Stable Audio 3.0 的开源权重 — jordiponsdotme · 2026-08-24
- Fable 雕塑能力惊艳,对比 Opus 5 完胜 — repligate · 2026-08-24
- 探索 Gabor 小波图像表示的生成模型 — pixlpa · 2026-08-24
- Opus 5 用 OpenSCAD 建模并生成手部动画 — repligate · 2026-08-24
- Opus 5 生成打斗场景动画:出拳踢腿鞠躬 — repligate · 2026-08-24