中文模型参数跃迁背后
soumitrashukla9 · x · 2026-07-20
转发内容在讨论:为什么中文模型会从 **800-1000B** 参数突然跳到 **2.4-2.8T** 这么大。 作者的判断是,这种规模跃迁通常意味着背后出现了新的 **硬件/算力解锁**,否则不仅训练,连推理这些大模型都会很难做。他的潜台词是:过去半年里并不是“突然更会训模型了”,而是基础设施条件发生了变化。
「Infra」频道最新
- 高通预览端侧 GGUF 运行工具GenieX — carrycooldude · 2026-07-20
- DwarfStar 让 Ada 卡盒变推理服务器 — antirez · 2026-07-20
- DwarfStar 新增多项推理优化 — antirez · 2026-07-20
- BMS 在 Vera Rubin 上建 AI 工厂 — nordicinst · 2026-07-20
- Hut 8 签下98亿美元AI租约 — sunychoudhary · 2026-07-20
- 中国开源模型重塑AI经济学 — Stratechery · 2026-07-20