传字节跳动正训练10万亿参数模型,Chamath指其缺乏蒸馏

markjeffrey · x · 2026-08-07

据《金融时报》(FT) 报道,字节跳动目前正在预训练一个参数量高达 10 万亿的模型,规模逼近神话级别。投资人 Chamath 转发该消息时指出,如果报道属实且该模型完全没有使用蒸馏技术来冷启动,那将证明许多事情是「价值毁灭」而非「价值创造」。

所属事件:字节被曝预训练5-10万亿参数大模型,张一鸣反对蒸馏(19 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →