快手提出反馈驱动框架,将 LLM 推荐策略蒸馏至轻量生成器

_reachsumit · x · 2026-07-31

快手团队发表论文《From Understanding to Action: Feedback-Grounded Policy Discovery for Generative Recommendation》,提出了一种解决大语言模型(LLM)在推荐系统中“理解-行动鸿沟”的新方法。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →