现代LLM的Deep Dream可视化
matthen2 · x · 2026-07-20
作者尝试用现代大模型生成“Deep Dream”风格的图像:通过优化输入图像来最大化特定提示词的概率。
对比发现,Gemma 12B(无视觉编码器,将像素视为token嵌入)会在画布周围生成可辨认的物体;而 E4B(带有视觉编码器)则更多表现为纹理的漂移。
所属事件:现代大模型复现Deep Dream可视化实验(2 条相关)→
「研究」频道最新
- 斯坦福团队推出全球最快分词器 Gigatoken — StanfordAILab · 2026-07-22
- Tabul AI 推出 Metal TreeSHAP,加速 Apple silicon 上的 Shapley 计算 — Scobleizer · 2026-07-22
- Reddit 转发 OpenAI 的 ChatGPT 广告页面 — EcstaticAsparagus509 · 2026-07-22
- 开源 runtime 让每个仓库自定义 AI 代码审查器 — ibabufrik · 2026-07-22
- DeepSWE:专攻真实 GitHub 场景的 AI 编码智能体评测基准 — pmz · 2026-07-22
- Claude 辅助写成的 Rust 太空经济模拟器,能跑数百艘自治船只 — kalcode · 2026-07-22