Meta 发 LIGE-GR:轻量模块加 RL 解码器,推荐系统升级为生成式排序
_reachsumit · x · 2026-09-17
Meta 团队在 arXiv 发布论文 LIGE-GR,探讨如何把 LLM 范式的序列级生成与优化融入成熟工业推荐系统。
核心做法:在现有逐条(itemwise)推荐器上加入一个轻量的上下文感知模块,并配以基于强化学习的解码器,将其平滑升级为 listwise 的 LLM 式生成排序,从而跨越从排序到生成式推荐的两个挑战——如何在推荐中引入序列级生成优化,以及如何兼容已成熟的现役系统。论文共 62 位作者,面向大规模线上场景。
「研究」频道最新
- Zoom 实证研究:上下文管理省成本,规划对强模型只是省钱手段 — ZoomCommunications · 2026-09-18
- VA-Bench 实测:最强模型具身操作任务成功率仅 53.9% — dalian-university-of-technology · 2026-09-18
- NVIDIA SoL-Pi:auto-research 循环让编码 agent 省一半 token — nvidia · 2026-09-18
- RiskChainBench:还原混淆消息到网页取证,十模型最高仅 62.8% — ZhuoXin Liu · 2026-09-18
- Vision-RL2:区域级强化学习让 MLLM 用 1/4 视觉 token 超越满分辨率 — Yuheng Shi · 2026-09-18
- 「The Pile 含 8% 基督教内容」论文遭打脸:关键词法误计长篇书籍 — cis_female · 2026-09-18