Midjourney 推理模式首测:输给 GPT Image,但观感更佳
koltregaskes · x · 2026-10-12
Midjourney 正在测试「thinking model」,试图缩小与 GPT Image 等模型在指令遵循上的差距,现已在 alpha 网站上线。
博主 @koltregaskes 用同一复杂提示词(纽约时代广场式十字路口、黄昏、150+ 行人、大量招牌文字、Canon EOS R5 相机参数)快速横评:
- GPT Image(图1):8.0/10 —— 构图、人群密度、文字准确性俱佳,仅少量遗漏和多余字母
- Midjourney thinking 模式(图2):5.3/10 —— 氛围和光影出色,但行人不足、细节缺失、多处文字错误
- Midjourney 无 thinking(图3):5.0/10 —— 环境细节和反射不错,但广告牌准确性弱、人群稀疏
结论:GPT Image 轻松胜出,两个 Midjourney 版本水平接近,thinking 模式在文字准确性上略胜。作者补充:抛开准确性不谈,Midjourney 的画面观感明显更好看。
所属事件:Midjourney 推理模式首测不敌 GPT Image 但观感更佳(3 条相关)→
「多模态」频道最新
- GPT-6 Image 2.5 复刻印度民间画:婚房墙上的红金叙事 — DeryaTR_ · 2026-10-12
- Kroma 写实电影感人像生成示例:8 步、CFG 1.0 即可出图 — AgeNo5351 · 2026-10-12
- X 网友接力晒 AI 生成"吸血鬼"喵系女角色美图 — Loo_Atreides · 2026-10-12
- GaussiAnimate 把 4D 采集压缩成可绑定骨骼的 3D 资产,无需物理仿真 — janusch_patas · 2026-10-12
- AI 生成的动画版哈利·波特片段火了,网友催更七部全集 — selfawareatom · 2026-10-12
- 为游戏做角色卡牌美术,Reddit 求教该选哪款图像生成模型 — CanBeUsedAnywhere · 2026-10-12