快手 RecHarness:用 LLM 自动迭代推荐系统架构
_reachsumit · x · 2026-08-03
快手提出 RecHarness 框架,利用大语言模型(LLM)自动化优化推荐模型,减少人工试错成本。
- 解耦设计:Bandit 路由器负责根据历史反馈选择优化方向,LLM 负责生成具体的优化假设和代码修改。
- 跳出局部最优:引入 jump-basin 机制,在局部修改停滞时激活结构跳转,维持长期探索能力。
- 业务效果:在 7 天的线上 A/B 测试中,广告收入提升 0.534%,曝光量提升 0.559%。
「研究」频道最新
- 一键生成学术论文:开源工具包实现23阶段全自动研究流程 — tom_doerr · 2026-08-03
- Awesome AI Memory:大模型与智能体记忆系统知识库 — tom_doerr · 2026-08-03
- Google 推出 Science One 框架:构建可信的自主科研智能体 — maier_ak · 2026-08-03
- 亚马逊提出QASP向量搜索策略,大幅减少数据访问 — _reachsumit · 2026-08-03
- GenCDSR:混合分词加速跨域推荐生成 — _reachsumit · 2026-08-03
- Snapchat推出基于LLM的生成式检索系统,用于短视频推荐 — _reachsumit · 2026-08-03