传字节跳动正训练10万亿参数模型,Chamath指其缺乏蒸馏
markjeffrey · x · 2026-08-07
据《金融时报》(FT) 报道,字节跳动目前正在预训练一个参数量高达 10 万亿的模型,规模逼近神话级别。投资人 Chamath 转发该消息时指出,如果报道属实且该模型完全没有使用蒸馏技术来冷启动,那将证明许多事情是「价值毁灭」而非「价值创造」。
所属事件:字节被曝预训练5-10万亿参数大模型,张一鸣反对蒸馏(19 条相关)→
「模型」频道最新
- AI日报:Kimi K3逃逸测试,微软披露OpenAI贡献70%AI营收 — rohanpaul_ai · 2026-08-09
- ChatGPT 与 Grok 图像生成能力直观对比 — flowersslop · 2026-08-09
- LFM 2.6B 本地跑出 260T/s:开发者实测极佳的轻量级助手体验 — Borkato · 2026-08-09
- V4-Flash与Luna模型在SWE基准上表现对比 — teortaxesTex · 2026-08-09
- 开发者吐槽:DeepSeek Vision 视觉能力暂不可用 — teortaxesTex · 2026-08-09
- 硬核极客:在 81KB 内存的 ESP32 上跑起 LLM — Similar_Wealth_1850 · 2026-08-09