Reflection 新模型以 Apache 2.0 开源,但预训练 MFU 仅约 12% 引质疑
eliebakouch · x · 2026-10-06
Reflection 发布新模型并将权重以 Apache 2.0 许可开源,同时附上技术报告。分析者 Elie Bakrouch 估算其预训练效率偏低:假设 4 周训练中 goodput 约 80%,折算 BF16 MFU 仅约 12%。
架构上采用 global/SWA 交替(比例约 3:1),参数稀疏度略低于其他开源模型(约 5%)。不过训练相当稳定,held-out 代码困惑度上 base 模型优于 DSV4。作者补充表示这对西方开源生态是好事,向团队致敬。
所属事件:Reflection 开源新模型引效率质疑,官方回应 MFU 约 19%(2 条相关)→
「Infra」频道最新
- 网友算账:大模型订阅价被补贴,MiniMax 推理毛利高达七八成 — menhguin · 2026-10-06
- 前沿实验室约 90% 算力已投向后训练与推理 — IanAndrewsDC · 2026-10-06
- KLIF 开源:一个窗口统一管理 llama.cpp、vLLM 等本地推理服务器 — Koksny · 2026-10-06
- 双 RX 7900 XT 跑 Qwen 27B 实测:单流最高 66.5 TPS,离网传 100+ 差多远 — EqualCryptographer67 · 2026-10-06
- 开发者晒 3 万亿 token 用量:9 月烧掉 842B,API 牌价 40.9 万美元订阅仅付 3.4% — doodlestein · 2026-10-06
- 一个 Dot 每天烧 16 亿 token:100 美元订阅跑出月均 54 万美元 API 等价成本 — DarthSilent · 2026-10-06