现代LLM的Deep Dream可视化

matthen2 · x · 2026-07-20

作者尝试用现代大模型生成“Deep Dream”风格的图像:通过优化输入图像来最大化特定提示词的概率。

对比发现,Gemma 12B(无视觉编码器,将像素视为token嵌入)会在画布周围生成可辨认的物体;而 E4B(带有视觉编码器)则更多表现为纹理的漂移。

所属事件:现代大模型复现Deep Dream可视化实验(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →