Beam 被指是 DeepSeek V3 的等算力复刻:23B×23.8T ≈ 同 FLOPs 但效率落后

mike64_t · x · 2026-10-06

teortaxesTex 指出 Reflection 的 Beam 模型是 DeepSeek V3 的 iso-flop 复刻:23B×23.8T ≈ 37B×14.8T(比值约 0.9996),即两年后用相近总算力复现了 V3。但复现的不是 V3 的效率——其推算称在"中国量化玩家"手里,一块阉割版 H100 能顶 NVL72 里的一块 GB300,暗示训练效率差距巨大。mike64t 以此作为"西方实验室不会预训练"的例证。

所属事件:开源新模型 Beam 发布:编码实测落后中国模型,被指 V3 等算力复刻(5 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →