ChatGPT 图像编辑暗藏空间伪影:多次迭代引发底层网格纹理
DickHorner · reddit · 2026-08-14
一位开发者深入研究了 ChatGPT(及类似 LLM)在图像生成与编辑中反复出现的一种底层伪影。发现在经过多轮生成式编辑后,图像的低细节区域(如背景、皮肤)容易出现云状或斑驳的纹理。
作者通过实验揭示了几个核心现象:
- 空间绑定特性:将图像平移 20 像素后再修复,伪影的分布会随之改变,证明这种伪影与模型的输出画布存在固定的空间相位关系。
- 隐式主体保护:对比中间产物发现,模型似乎在内部生成了粗糙的主体掩码,使得人脸和身体区域比背景墙更稳定。
- 黑图测试:生成纯黑图像时,像素值并非全零,而是包含稀疏的非零像素。多张独立生成的黑图之间,非零像素的重合度极高(相关性达 0.848),证实了模型生成时存在固定的底层空间网格模式。
「多模态」频道最新
- MiniMax Music3 本地实测:最佳开源 AI 音乐模型 — MattVidPro · 2026-08-14
- AI图像生成太强,大品牌广告已开始采用 — Vjeux · 2026-08-14
- RTX 5090 跑 H3 模型对口型:30 秒视频耗时 12 分钟 — R34vspec · 2026-08-14
- 探讨 AI 视频片段无缝拼接:如何消除转场运动卡顿 — PizzaLater · 2026-08-14
- AI 现实秀突破:fAIkout 推出 20 分钟长视频 — AIandDesign · 2026-08-14
- 实测 MiniMax H3:双片段链接生成 30 秒连贯故事 — GamerVick · 2026-08-14