曝字节正训练最高10万亿参数大模型,张一鸣称不走蒸馏捷径

APPSO · wechat · 2026-08-07

据《金融时报》报道,字节跳动正训练最高可达 10 万亿参数的超大规模基础模型,目前处于预训练早期,最终规模尚未敲定。若属实,这将成为中国已知最大模型,直接对标 Anthropic 等全球头部实验室。

字节 Seed 团队规模约 2000 人,覆盖全链路研发。创始人张一鸣近期在内部明确表示,不会把“蒸馏”领先模型当作提升能力的捷径,而是坚持自主训练路线。文章认为,随着国内外模型差距缩小,下一阶段竞争的核心在于探索独立训练路线并触碰能力边界,而字节正选择在 Scaling 上大力出奇迹。

所属事件:字节被曝预训练5-10万亿参数大模型,张一鸣反对蒸馏(19 条相关)→

原文链接 →

「公司和人」频道最新

更多「公司和人」频道 AI 资讯 →