Magic 宣称预训练效率提升 10 倍,公开技术细节
meetpateltech · hn · 2026-09-09
Magic 发布博客,声称其新方法可将 LLM 预训练效率提升约 10 倍。文章讨论了当前预训练的效率瓶颈,并介绍其改进方案如何在大规模训练中显著降低算力成本。对关注 scaling 与训练成本的人来说值得细读原文。
「Infra」频道最新
- M.2-Oculink 显卡链路暗降 PCIe 1x,附 lspci 排查命令 — El_90 · 2026-09-11
- DeepSeek 发布 V4.1-Flash:百万 token 上下文,KV 缓存缩小 4 倍 — matlabulous · 2026-09-11
- 8GB 显存还能干嘛?网友求解小模型现状与推荐 — riceinmybelly · 2026-09-11
- 西班牙新规要求 80% 逐小时绿电匹配,数据中心建设或耗资千亿欧元 — eherrerosj · 2026-09-11
- Draghi 引用 ECB 研究:AI 或每年提振欧洲生产率 0.3-0.4 个百分点 — rohanpaul_ai · 2026-09-11
- 高通新一代 Hexagon NPU 曝光:可跑 30B MoE,上下文 32K — lee_stott · 2026-09-11