无模态区分的生成式推荐器,从图像和文本学同一个 tokenizer
_reachsumit · x · 2026-08-04
一个无模态区分的生成式推荐方法,统一学习图文与单模态数据
这篇论文提出了一种 modality-agnostic generative recommendation 方法,可以同时利用配对数据、仅图像数据和仅文本数据。
- 核心是学习一个跨模态共享的 semantic-ID tokenizer。
- 这样做的目标,是在训练数据不完整或不成对时,依然能把推荐学习统一起来。
- 论文强调,该方法可以利用异构的商品来源,而不要求每条样本同时具备图像和文本。
「多模态」频道最新
- MiniMax高管回顾海螺AI成长史,宣布将推进开源 — VoidAsuka · 2026-08-04
- 用 Hailuo AI 制作海报动画:提示词与实测效果 — LudovicCreator · 2026-08-04
- 实测 Qwen3.8-Max:用 Three.js 生成高保真布加迪引擎 — cedric_chee · 2026-08-04
- RTX 3060 12G 实测:17 分钟本地生成 10 秒竖屏视频 — merica420_69 · 2026-08-04
- 告别乱连线:ComfyUI 节点输出可视化调试工具发布 — niknah · 2026-08-04
- 字节跳动 Douyin 多模态 embedding 模型拿到 MMEB-v2 SOTA — _reachsumit · 2026-08-04