Magenta 宣称用 1/50 算力复现 DeepSeek V4 Pro 预训练,成本约 50 万美元
generativist · x · 2026-09-09
Magenta AI(@magicailabs)发帖称,前沿预训练通常被认为是只有大厂才玩得起的游戏,他们没有 10 万张卡,唯一的出路是算法效率。其新配方用约 1/50 的算力匹配了 DeepSeek V4 Pro 的预训练效果——大约只有 GPT-3 一半的 FLOPs,在 GB200 上约合 50 万美元。多家 AI 圈人士转发称「big if true」,但该说法未经验证,细节取决于其论文/复现情况,宜谨慎看待。
所属事件:Magic 宣称 1/50 算力匹敌 DeepSeek V4 Pro 预训练(11 条相关)→
「Infra」频道最新
- M.2-Oculink 显卡链路暗降 PCIe 1x,附 lspci 排查命令 — El_90 · 2026-09-11
- DeepSeek 发布 V4.1-Flash:百万 token 上下文,KV 缓存缩小 4 倍 — matlabulous · 2026-09-11
- 8GB 显存还能干嘛?网友求解小模型现状与推荐 — riceinmybelly · 2026-09-11
- 西班牙新规要求 80% 逐小时绿电匹配,数据中心建设或耗资千亿欧元 — eherrerosj · 2026-09-11
- Draghi 引用 ECB 研究:AI 或每年提振欧洲生产率 0.3-0.4 个百分点 — rohanpaul_ai · 2026-09-11
- 高通新一代 Hexagon NPU 曝光:可跑 30B MoE,上下文 32K — lee_stott · 2026-09-11