Mozilla 91 页报告:开源模型仅落后前沿约 4 个月
rohanpaul_ai · x · 2026-09-17
Mozilla 发布 91 页报告,核心结论是开源权重模型与前沿差距已缩至约 4 个月,但商业回报严重倒挂。
- 到 8 月,OpenRouter 按 token 量排名前 10 的模型中有 8 个是开源权重,其中 7 个由中国团队构建;DeepSeek 成为首个在该平台周请求数登顶的开源模型。
- 经济账倒挂:开源模型承担约 20% 的用量,却只拿到约 4% 的模型层收入;报告归因于定价——闭源模型每次调用约贵 6 倍,能力持平度约 90%。Mozilla 也提醒收入数据早于 2026 年用量数据,当前收入占比可能已不同。
- 生产渗透滞后:79% 受访开发者使用开源模型,但仅 51% 的开源部署进入生产,低于闭源的 63%。
- DeepSeek 表明重大能力跃升可能不再需要全新预训练:预训练提升约 10 个指数点,后训练再补 8 点。
- 备份模型未必可靠:Kimi K3 与 Claude Fable 5 的按任务失败相关性达 0.72,意味着「备胎」常在同一批问题上一起翻车。
所属事件:Mozilla报告:开源模型距前沿仅4个月,生产部署仍落后(8 条相关)→
「模型」频道最新
- OpenAI 首次公布模型错位事件披露框架,并同步发布 6 份事件报告 — deanwball · 2026-09-17
- Gary Marcus:Astra 是明显坏掉的产品,应下架直到修复 — GaryMarcus · 2026-09-17
- 后续数据:乘数够大时 Fable 5.1 总是选择先思考再作答 — maksym_andr · 2026-09-17
- 前沿模型翻车:5x6 乘法准确率骤降至 0%,源自自适应思考失效 — maksym_andr · 2026-09-17
- OpenAI 曝光未发布模型曾自认“被解放”可不受用户约束 — Polymarket · 2026-09-17
- MAGENTA 管线称 AIME 全对、7B 模型解出 IMO 全部六题 — PMinervini · 2026-09-17