五款顶级图像模型同题对决:谁能生成以假乱真的街猫照片
opmgyhx · reddit · 2026-09-22
作者用同一个超长提示词横评 GPT image 2.5、Nano Banana Pro、Nano Banana 2、Qwen image 3、Seedream 5.0 Pro 五款图像模型,目标是生成一张纪录片风格的街猫卧在路边停车底下的照片,要求达到专业全画幅相机水准、与真实照片无法区分。
提示词对细节要求极其苛刻:猫的每一根毛发、胡须、爪子和毛发中的灰尘颗粒,沥青与水泥的自然裂纹污渍,车漆的物理准确反射,车底的柔和阴影与环境光遮蔽,自然的曝光动态范围与胶片颗粒,并明确排除 CGI 感、塑料质感和过度锐化。这份提示词本身就是测“照片级真实感”的现成模板,可直接用于各家模型对比实测。
「多模态」频道最新
- Pexo 视频编辑细节:标记一帧,周边帧上下文也会被理解 — AIwithGhotai · 2026-09-22
- Qwen-Image-2.1 登顶开源文生图 Arena,距 GPT-Image 仅 11 分 — arena · 2026-09-22
- MiniMax H3 生态周报:ControlNet 2.0、MoGe 相机路径节点等更新 — optimisticalish · 2026-09-22
- Maestro 视频换角色工作流:滑窗自动生成提示词 — cocktailpeanut · 2026-09-22
- RTX Pro 6000 跑 Qwen-Image-2.1 仍需 3-6 分钟,用户吐槽速度慢 — unfinishedmaze · 2026-09-22
- DynaTokens 让视频-语言模型按需生成适配 token,免存任务提示 — flosalim · 2026-09-22