ZooWork-ShopRanker 开源电商重排器,0.6B 到 8B 三档对齐购物偏好
kalyan_kpl · x · 2026-10-08
- 通用网页检索训练的重排器迁移到电商场景效果不佳:电商排序不仅看主题相关性,还取决于用户偏好、商品约束和多商品比较适配度。
- ZooWork-ShopRanker 是一系列开源电商重排器(0.6B、4B、8B),通过对齐裁判标注的购物偏好训练;训练对由不同厂商的多个推理型 LLM 组成的裁判团标注。
- 对齐后的 8B 旗舰模型作为蒸馏教师,再蒸馏出高效的 4B 与 0.6B 版本,并在裁判标注对上进一步打磨。
- 团队同时发布 ShopRank-Bench:约 1 万对私域偏好数据的防污染基准。
「研究」频道最新
- ProactiveCoach:分层程序理解让主动式 AI 助手性能提升 57 个百分点 — skku · 2026-10-08
- STEPQuant:6-bit 量化 Delta-rule 循环状态,服务内存最多省 68.7% — zju-community · 2026-10-08
- RoboQuest 基准:最强多模态智能体具身探索成功率仅 23% — declare-lab · 2026-10-08
- KAIST GRACE:令 Wan2.1-I2V 视频生成延迟降低 11.1 倍 — kaist-ai · 2026-10-08
- NVIDIA Long-WAM:扩展世界-动作模型上下文,动态堆杯成功率 95% — nvidia · 2026-10-08
- RobotWorld 基准:84 个物理任务测试多模态机器人智能体 — Zhiqin Yang · 2026-10-08