推算:美国最大在研模型约 8e26 FLOPs、800B 激活参数,需 170T tokens
teortaxesTex · x · 2026-09-15
TeortaxesTex 根据 DeepSeek 梁文锋 5 月披露的「美国人所知最大的在研模型」数据进行推算:若模型为 fp4 精度、跑在 Blackwell 上、计算量约 8.17e26 FLOPs、激活参数约 800B,加上合理的 4%-5% 稀疏度(总参数 16-20T),对应训练数据约需 170T tokens。他补充称 OpenAI 已能拿到 100T+ 的 token(引用 glm-oss 相关数据)。这是一条关于前沿模型规模和训练资源的大局估算,数据来源与假设均标注,但属于推测性质。
「Infra」频道最新
- 用500年历史教训反驳「禁数据中心救世界」论 — thursdai_pod · 2026-09-15
- 把运行中的整机一秒克隆 32 份,让 agent 团队不再受算力瓶颈 — bigaiguy · 2026-09-15
- 12GB 显存跑通 Qwen3.8-Flash-Next 125B MoE,MTP 加持逼近 21 tok/s — carteakey · 2026-09-15
- 扎克伯格公开喊话 Nvidia:求短线 DGX Station 跑本地模型 — beffjezos · 2026-09-15
- BIS 年报遭逐条拆解:H20 限制无正式规则、实体清单停摆、漏洞未堵 — ohlennart · 2026-09-15
- iOS 27 端侧模型 AFM 3 总参数 20B,动态激活仅 1-4B — rxwei · 2026-09-15