ZooWork-ShopRanker:LLM 评委标注的电商重排模型家族发布
Siqiao Xue · hf · 2026-09-28
面向电商场景的开源重排器系列:通用网页检索重排器迁移到电商效果不佳,因排序还依赖用户偏好、商品约束与比较适配,而这类偏好信号难以大规模人工标注。
- 模型:0.6B / 4B / 8B 三档,用多家族推理 LLM 组成「偏好评审团」做位置去偏的成对标注(含一致度分层),8B 旗舰再蒸馏给 4B 与 0.6B。
- 基准:配套发布约 1 万对私域流量偏好对的 ShopRank-Bench,按评委家族一致度分层、防污染,提供双文本格式。
- 结果:8B 与 4B 显著超过最强开源重排基线,各模型均优于未对齐版本,0.6B 赢过同尺寸对手;增益在两种格式及 MTEB 通用基准上均成立。
- 模型与基准均已开源。
所属事件:阿里系团队开源电商专用重排模型 ZooWork-ShopRanker(2 条相关)→
「研究」频道最新
- Hillock 开源引擎:用三元组+Hebbian 权重替代向量库,1.2GB 显存跑本地 agent 记忆 — Equivalent-Flan-1590 · 2026-09-28
- 北大开源 RayOrch:数据准备管线最高提速 15.14 倍 — PekingUniversity · 2026-09-28
- YODAS v3 发布:110万小时语音数据,史上最大开源音频数据集 — shinjiw_at_cmu · 2026-09-28
- 「图对齐就是你所需要的」报告登陆 CIRM 图论研讨会 — marc_lelarge · 2026-09-28
- AI 挑出"不靠谱"材料,催化剂抗酸超千小时 — VraserX · 2026-09-28
- 4.5MB 无 Transformer 语言模型 MICA 分家:Ember 与 Flame 评测进展 — Silver_Employ2617 · 2026-09-28