模型 Jev 被指从第一性原理重造 MaskGIT:并行预测每个像素作画

torchcompiled · x · 2026-09-17

开发者 anshuc 展示了图像生成模型 Jev 的作画过程:它通过并行预测每一个像素来生成图像,而非常见的自回归逐 token 方式。

torchcompiled 评论称这相当于从第一性原理重新发明了 MaskGIT——即 2022 年 Google 提出的掩码图像生成范式,通过并行预测被掩码的图像 token 实现快速生成。这条观察点出了当前部分新图像模型正在回归并行解码路线的趋势。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →