照片级真实感有三条独立轴线,大多数工作流只修了两条

24Latents · reddit · 2026-08-26

作者基于 Krea 2 + 角色 LoRA 的长期实践,提出 AI 生成图像的「照片级真实感」有三条相互独立的轴线:光学(对抗过于完美的镜头感,用颗粒/光晕/欠曝/倾斜修复)、场景(对抗样板间式布景,用杂物/磨损/偏轴家具修复)和主体姿态——最后这条几乎没人处理,是图像「技术上正确却仍像假」的关键。

核心论点:candid documentary photo 等风格 token 只改变渲染风格,不改变姿态。当主体没有动机性动作时,模型会退回其训练数据中最常见的目录式摆拍:正面、居中、对称、眼睛看镜头;角色 LoRA 反而叠加肖像先验让问题更糟。

五个修正杠杆(按强度排序):

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →