Beam 被指是 DeepSeek V3 的等算力复刻:23B×23.8T ≈ 同 FLOPs 但效率落后
mike64_t · x · 2026-10-06
teortaxesTex 指出 Reflection 的 Beam 模型是 DeepSeek V3 的 iso-flop 复刻:23B×23.8T ≈ 37B×14.8T(比值约 0.9996),即两年后用相近总算力复现了 V3。但复现的不是 V3 的效率——其推算称在"中国量化玩家"手里,一块阉割版 H100 能顶 NVL72 里的一块 GB300,暗示训练效率差距巨大。mike64t 以此作为"西方实验室不会预训练"的例证。
所属事件:开源新模型 Beam 发布:编码实测落后中国模型,被指 V3 等算力复刻(5 条相关)→
「Infra」频道最新
- Strata v0.1.40 发布:支持 Strix Halo 与多 GPU 批处理改进 — lxfater · 2026-10-06
- QNX 营收创纪录达 8030 万美元,黑莓转型 AI 嵌入式软件平台 — alysha_lobo · 2026-10-06
- 跑了几十小时端到端基准,Strata 推理服务器在完整构建任务上翻车 — julianharris · 2026-10-06
- R9700 32GB 本地跑 i2v 提速难:用户指 Windows 下 ROCm 表现糟糕 — vladomkd · 2026-10-06
- CutBCE:Google JAX TPU 核消除大规模推荐 BCE 训练 OOM,提速 91.9% — _reachsumit · 2026-10-06
- 8-16GB 显存新思路:通用模型编排多个领域专家小模型 — CyberExplore · 2026-10-06