Nathan Lambert:中国开源权重模型领先美国约1.6B下载量
Interconnects (Nathan Lambert) · rss · 2026-09-21
Interconnects 作者 Nathan Lambert 分享了向美国国会议员简报开源模型现状的演讲稿,核心结论:自2025年4月起,中国公司已明确主导开源权重(open-weight)模型领域。
开源光谱
- 开源权重模型(Llama、Qwen、Gemma、DeepSeek)公开权重但有许可证限制;真正的「开源」模型还需含训练代码与数据,目前主要由美国非营利机构(AI2 的 Olmo、EleutherAI 的 Pythia 等)主导。
中美竞争格局
- Hugging Face 下载量上中国自2025年7月反超,目前领先约16亿次(总下载32亿,是美国两倍)。
- Artificial Analysis 指数上,中国模型 GLM-5.3(45)、Kimi K3(44)、GLM-5.3-Flash(42)大幅领先美国最强的 Inkling(26)和 Nemotron 3 Ultra(23);美国最强开源模型落后中国同类15个身位。
- 中国开源权重模型距美国闭源前沿约2-5个月;美国开源模型距 OpenAI/Anthropic 约6-9个月。中国模型在 agentic coding 等有明确需求的方向最接近前沿。
原因与蒸馏争议
- 中国实验室发布节奏更快、任务面更窄;2026年起头部中国实验室开始付费购买前沿 RL 训练环境数据。
- Lambert 估算:即使完全禁止蒸馏,中美开源差距也只会扩大1-2个月。
风险与政策建议:开源权重难以阻止落入恶意者之手,但限制中国模型受害的反而是美国企业(HuggingFace 曾靠中国开源模型分析网络攻击)。作者主张美国应继续投资开源模型以掌控风险协调权。
「漫话AGI」频道最新
- 18 个月前 math+AI 会上被嘲笑的预测,如今已显保守 — prof_g · 2026-09-21
- Bindu Reddy:用弱模型干难活,正制造海量 AI slop 污染 — bindureddy · 2026-09-21
- 随便问几句测不出模型实力:数据污染让「随手 prompt」结论不可靠 — iamKierraD · 2026-09-21
- 《代码整洁之道》作者谈 AI 风险:装护栏但全速前进 — mark_k · 2026-09-21
- Molecule 团队走进罗氏健康工作室,谈 AI 重塑医疗价值链 — melnykowycz · 2026-09-21
- 达特茅斯教务长文章被「近零误报」检测器判定 96% AI 撰写 — paulnovosad · 2026-09-21