Meta 推荐系统达 LLM 规模,自研注意力内核使训练效率翻倍

Meta_Engineers · x · 2026-08-05

Meta 官方发文透露,其驱动 Instagram 和 Facebook 广告的生成式推荐模型(GEM)已跨数千张最新 GPU 进行 LLM 规模的训练。由于标准 LLM 基础设施无法直接用于推荐工作负载,Meta 团队协同设计了多种定制化底层组件:

通过这些优化,Meta 在 12 个月内将总训练 FLOPs 扩大了 4 倍,同时将端到端训练效率(MFU)翻倍至 20–25%。

所属事件:Meta广告推荐模型达LLM级规模且训练翻倍(3 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →