研究发现 ChatGPT 图像生成存在可复现的低级模式伪影
DickHorner · reddit · 2026-08-17
用户在测试 ChatGPT 图像生成与迭代编辑时,发现了一种与画布对齐的、非随机的纹理伪影,并通过一系列实验验证了其可复现性。
现象:
- 在对肖像进行多轮生成式编辑后,本应平滑的背景(墙壁、皮肤等)会出现隐约的云状/斑点纹理。
- 重复编辑会强化纹理,且某些区域(如人脸)似乎受到保护,比背景更稳定。
关键实验:
- 图像位移:将图像移动 20 像素后再修复,发现伪影强度随相位关系变化,暗示其与底层画布坐标绑定,而非随机噪声。
- 黑图测试:生成多张“全黑”图像,对比发现这些看似全黑的图片在像素层面存在显著的相关性(非零像素掩码相关性 0.848,Jaccard 重叠 0.766)。如果像素是随机独立的,重叠率应极低。
这表明模型可能存在某种内部的空间结构模式或处理机制,导致非随机性伪影在特定条件下显现。
「多模态」频道最新
- Grok Imagine 2.0 生成惊艳艺术图,网友晒图 — mark_k · 2026-08-17
- MiniMax b15-49 变体大幅提升语音克隆质量 — Foreforks · 2026-08-17
- Midjourney v8.2 关键词是 SCALE:极致规模 — ciguleva · 2026-08-17
- AI 生成的音乐视频 Opus 5 - Not Tonight — repligate · 2026-08-17
- Gemini 3.7 Flash生成SVG猴子,展示多模态能力 — intellectronica · 2026-08-17
- 1567 年名画竟预言了 AI 的多指幻觉现象 — docmilanfar · 2026-08-17