HiLaR 框架:用分层强化学习优化 LLM 推荐推理

_reachsumit · x · 2026-07-31

论文《Hierarchical Latent Reasoning for LLM-based Recommendation》提出了一个名为 HiLaR 的框架,旨在解决大语言模型(LLM)在推荐系统中的推理成本与效果问题。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →