Interconnects 长文盘点:开源模型逆势繁荣,Kimi K3 与 DeepSeek 齐发力
Interconnects (Nathan Lambert) · rss · 2026-08-02
知名AI博主 Nathan Lambert 在最新一期开源模型盘点中指出,尽管业界曾预测高昂的训练成本会导致大模型领域走向整合,但事实恰恰相反:开源生态正迎来前所未有的繁荣。随着对 token 需求的激增,越来越多公司意识到构建“token 机器”是创造价值的可行路径。
本期盘点重点介绍了多款最新开源模型:
- Thinking Machines (Inkling):首个 975B-A41B 多模态 MoE 模型,虽绝对性能并非同级别最强,但极具微调潜力,并带动了其商业微调服务的高营收。
- Tencent (Hy3):295B-A21B MoE 模型,不仅全指标超越前代,更将许可证从限制性条款切换至宽松的 Apache 2.0。
- Poolside (Laguna S2.1):专为代码等场景打造,采用对 AI 更友好的 OpenMDW 许可证,并提供了极高的评估透明度。
- DeepSeek (V4-Flash-0731):紧随 OpenAI 降价 80% 之后推出更新,在帕累托前沿上击败了同级别竞品。
- Moonshot (Kimi K3):近期最重要的开源发布之一,但采用了非商业许可证,要求推理和微调提供商签署商业协议。文章指出,这种授权模式未来可能会引发美国政府的监管干预。
- Meituan (LongCat-2.0):1.6T 参数的 MoE 模型,最引人注目的是其完全使用华为昇腾 910 芯片训练,是首个非华为出品的纯国产算力大模型。
「模型」频道最新
- 微软曝光首款原生实时双向语音模型 MAI Realtime — testingcatalog · 2026-08-02
- 8B 小模型击败前沿大模型,Replit CEO 的国际象棋引擎破 1500 Elo — amasad · 2026-08-02
- 实测:缺必填参数时,部分 AI 模型会编造邮箱地址 — eliobldr · 2026-08-02
- 垂直AI公司加速增长:开源微调与路由技术大幅优化成本 — lqiao · 2026-08-02
- 超三分之一网络文本由 AI 生成,Pangram 4 检测误判率仅四万分之一 — aftahi_ai · 2026-08-02
- 开发者吐槽 Opus 5:修 Bug 变成无意义重构,疯狂跑偏 — JoshuaJBouw · 2026-08-02