腾讯混元提出原生多模态预训练最优缩放规律

腾讯混元团队最新发表论文,系统研究了从零开始的原生多模态预训练。研究聚焦于在固定算力预算下,vision-language模型的最优模型规模、token数量与数据配比。结果表明,语言与视觉等多模态融合训练的最小损失遵循可预测的计算规律,为未来大规模多模态模型的算力分配与架构扩展提供了理论指导。

2026-07-27 ~ 2026-07-28 · 2 条相关