两个月重度实测:图像生成离「艺术指导级」精准控制还很远
Professional-Cap-377 · reddit · 2026-09-23
一位在 ComfyUI 重度使用图像生成两个月的作者总结当前局限:Krea 2 Turbo 光影、风格、人体结构不错,但一旦想做具体的艺术指导就崩溃——例如「男孩拔手上的刺」几乎不可能生成,换「小金属钉」后又无法控制长度比例。
- 微小结构调整仍是难题:视线方向、手臂微转、手指握物方式、腕部角度、物体间关系,动一处全图跟着变
- Krea Agent 也时灵时不灵,只能反复抽卡碰运气
- 图像编辑/image-to-image 工具多围绕摄影场景优化(换装、换发型、补光),对数字绘画式的微小结构性修改和风格语言保持很差
- 用 DAZ 3D 摆姿势做底图可行但极其耗时且僵硬;对新一代模型(如 Sunburst 2.5)的期待落空
结论:从「生成近似想法」到「可精确艺术指导」,当前技术仍有明显鸿沟。
「多模态」频道最新
- 用 Opus 5.5 做像素风游戏动画:几分钟出 Pitfall 式小样 — technollama · 2026-09-23
- 网友用 Claude Opus 5.5 生成「Fear The Foom」动画,配合 AI 诗写成片 — repligate · 2026-09-23
- Polyfork 把 3D 资产变成可重混的小程序,AI agent 全流程搭建已周周有收入 — PeterDiamandis · 2026-09-23
- ghost-2.0 全头换脸项目被修复升级,效果仍有差距 — Working-Art-3746 · 2026-09-23
- 用户首试 GPT-6 Astra 剪视频:称这活儿从此不用再想 — debreuil · 2026-09-23
- Qwen-Image-2.1 登顶双图像竞技场,开源第一仅距 GPT-Image 3 分 — Alibaba_Qwen · 2026-09-23