开源模型算力足迹对比与开放权重讨论
teortaxesTex · x · 2026-07-07
讨论开源模型的算力足迹与预训练规模,指出 gpt-oss、MiMo 等已有相近算力且预训练 token 超过 40T 的开源模型;并提到 DeepMind 的 Demis 曾以算力不足为由解释不开放权重,而 Gemma 4 项目的算力规模与 GLM 5.2、DSV4 相当。
「模型」频道最新
- 一条暗示帖把 GLM 5.5 的发布时间推近了 — mark_k · 2026-07-21
- Nemotron 3 Ultra 预测榜表现突出 — kuchaev · 2026-07-21
- Kimi K3 登上 Agent Arena 第4 — arena · 2026-07-21
- Qwen 3.8 口碑分化 — davidtsong · 2026-07-21
- SuperGrok Heavy重回99美元/月 — Daniel_Farinax · 2026-07-21
- 一天实测Kimi K3:上限高但代价大 — Tarandjpop · 2026-07-21