中国 AI 实验室并非一类人,阿里 DeepSeek 蚂蚁各押不同路线
Alekseener33 · reddit · 2026-07-27
这条 Reddit 长帖的核心观点是:中文圈常把中国 AI 实验室混成一团,但它们其实在押完全不同的东西。
作者把几家代表性的路线拆开讲:
- 阿里 / Qwen:押分发和覆盖面,大小规格、量化版本、运行时支持都尽量铺全,因此大量微调都从 Qwen 基座起步。
- DeepSeek:押架构创新,论文和权重往往同步放出,让设计本身说话。
- Moonshot:更像在押更长周期的回报,某一版看起来“怪”一点也没关系,只要后面两代能兑现。
- 蚂蚁 Ling:押服务成本。文中提到的 Ling-3.0-flash 是一个 124B MoE 模型,每 token 约 5.1B active,采用 KDA + MLA 混合注意力,支持 262K 上下文,目标是把长链路 agent 跑得便宜,而不是冲榜。
帖子还批评了蚂蚁的发布顺序:先宣布、后开放权重。这样对基础设施团队更稳,但对想本地跑模型的人来说,热度和好感度会打折。作者最后抛出一个问题:当你看到一家中国实验室的新发布时,知道具体是哪家,真的会改变你的解读吗?
「公司和人」频道最新
- 1127 家样本显示,B2B 创业公司全面强于 B2C — marclou · 2026-07-28
- 作者称 AI 时代分发比搭产品更重要,自己只押两条渠道 — eptwts · 2026-07-28
- Palantir 的前线部署工程师模式正在被全行业复制 — BrettKrieger12 · 2026-07-28
- AI SDR 达标也未必能带来真实收入 — chiefmartec · 2026-07-28
- Anthropic 解释 Claude CEO 未签开放模型协议原因 — EverydayAI_ · 2026-07-28
- Anthropic CEO 再谈开放权重模型的严重滥用风险 — The Decoder · 2026-07-28