无模态区分的生成式推荐器,从图像和文本学同一个 tokenizer
_reachsumit · x · 2026-08-04
一个无模态区分的生成式推荐方法,统一学习图文与单模态数据
这篇论文提出了一种 modality-agnostic generative recommendation 方法,可以同时利用配对数据、仅图像数据和仅文本数据。
- 核心是学习一个跨模态共享的 semantic-ID tokenizer。
- 这样做的目标,是在训练数据不完整或不成对时,依然能把推荐学习统一起来。
- 论文强调,该方法可以利用异构的商品来源,而不要求每条样本同时具备图像和文本。
「多模态」频道最新
- 好莱坞没有封杀 Seedance,创作者已用上 2.0/2.5 版本 — CurieuxExplorer · 2026-09-21
- Qwen 团队发布 OmniVChat:原生音视频对话的数据引擎与基准 — Qwen · 2026-09-21
- Seedance 2.5 实测:目标做到真假视频难分辨 — aziz4ai · 2026-09-21
- Magnific 提图 × MiniMax H3 生视频:一条 AI 短片工作流 — aziz4ai · 2026-09-21
- Arena 图生视频榜:MiniMax 本周超越所有开源与闭源模型登顶 — robertwellesley · 2026-09-21
- 开发者实测:用「GPT-6 Astra」加 Hyper3D Rodin MCP 自动生成 3D 素材做游戏 — CodeByPoonam · 2026-09-21