自建物理实验室数据练出万亿参数模型,达内存效率SOTA

vwxyzjn · x · 2026-09-16

zijiey 透露其团队用自家物理实验室产生的数据训练了一个万亿参数模型,并称这句话背后藏着大量训练基础设施工作:长科学轨迹对内存与并行性是极大考验,团队最终在内存效率和长上下文训练性能上达到 SOTA,从而能更快尝试更多想法,相关成果已进入 Neon 项目。Bahdanau 转发称赞其为「前沿级训练的 GOAT」,并透露团队正在招聘一位新同事,职位 posting 即将发布,可先私信联系。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →