Vector Institute 分享 350 亿参数 MoE 微调实践

Vector Institute 的 AI 工程团队详细拆解了在有限算力下微调 350 亿参数多模态 MoE 模型的实践。团队最初测试了 5 种配置,但因显存溢出全部失败。最终他们探索出成功方案:保持 MoE 层完整不分片,并叠加 4-bit 量化、Flash Attention 2 以及特定卸载策略这三项优化。该经验属于旨在开发可解释 AI 的 AIXPERT 计划,深入探究了模型内部的路由机制。

2026-07-30 ~ 2026-07-30 · 3 条相关