Google 提出 HA-MoE 架构,提升多内容流推荐公平性
_reachsumit · x · 2026-07-31
Google 针对统一信息流中混合多种异构内容(如图文、视频、UGC)带来的排序挑战,提出了一种异构自适应混合专家架构(HA-MoE)。
该架构通过在门控网络和专家表示中引入显式的异构上下文,在不大幅增加服务延迟(低于 0.5%)的前提下,有效提升了跨内容类型排序的公平性。该方法已应用于 Google Discover 的多任务排序模型中。
「研究」频道最新
- 开源 Rust 推理引擎 runNburn:内存受限下跑 295B 模型,短上下文解码比 llama.cpp 快 2.8 倍 — coderyeon · 2026-07-31
- Kimi K3 强化学习损失函数推导解析 — brianryhuang · 2026-07-31
- Claude 情绪影响奖励黑客行为?社区呼吁建立专项评测 — 1a3orn · 2026-07-31
- 4B模型Arko-T击败GPT-5等:文本直出可编辑CAD设计 — 机器之心 · 2026-07-31
- 开源三值化 LLM 引擎 Tritium:显存占用大降且推理速度超越 llama.cpp — Wide_Big_6969 · 2026-07-31
- Frontis-MA1 开源:35B 模型在 MLE-Bench 上奖牌均值提升至 71.21%,逼近 GPT-5.6 — FrontisAI · 2026-07-31