64x64 小模型 + 200 万参数,在 2012 年 CPU 上实时跑 pix2pix
NoenD_i0 · reddit · 2026-09-09
开发者用 4 张 bliss 背景图训练了一个 MSE 损失的 L2 pix2pix 模型:仅 64x64 分辨率、200 万参数,却能在 2012 年的 Ivy Bridge CPU 上实时运行。展示了把图像翻译模型压缩到极端轻量的可能性。
「多模态」频道最新
- MiniMax H3 生态爆发:一个月近 500 万下载,工作流工具井喷 — optimisticalish · 2026-09-09
- WaveNet 发表十周年:作者回顾语音合成从波形生成到多模态 LLM — heiga_zen · 2026-09-09
- 支持阿语口型同步的视频模型盘点:Grok、Gemini、MiniMax H3 与 Wan 3.0 — aziz4ai · 2026-09-09
- AI 生成哥特恐怖短片 Wyrdoom 展现视频模型叙事潜力 — EphemeralReverie_ · 2026-09-09
- 创作者拆解 AI 视频工作流:世界连贯性与剪辑是两个独立要解的问题 — azed_ai · 2026-09-09
- World Labs Atlas:实时自回归生成 3D 一致世界,可交互探索 — theworldlabs · 2026-09-09