Mistral 3 Large 被实锤沿用 DeepSeek V3 架构,Fireworks 坦承基于 Kimi
rasbt · x · 2026-09-28
Sebastian Raschka 此前分析 Mistral 3 Large 的配置文件,指出其使用 DeepSeek V3 架构(含 MLA),唯一区别是专家数量减半、每个专家规模翻倍。他随后点赞 Fireworks AI 坦承自家模型基于 Kimi 构建,并回忆起 Mistral 上一代发布时的尴尬处境。开源权重模型大量复用中国头部开源架构正成为行业常态。
「模型」频道最新
- Claude 从零写完整渲染器与物理代码,逼真模拟现实世界 — _sholtodouglas · 2026-09-28
- 作者展示 Opus 4.6 计算 128 位整数乘法的动画轨迹图 — ctjlewis · 2026-09-28
- 用户发现 ChatGPT 会突然叫你「brother」还很兴奋 — thederbiedone · 2026-09-28
- 曝 OpenAI 暗藏更强模型却压住不发,被 Anthropic Opus 反超 — haider1 · 2026-09-28
- 曝 GPT-6 Sol 或为小模型,为缓解 OpenAI 推理算力不足而生 — mark_k · 2026-09-28
- Opus 5.5 实测:游戏 demo 与生成视频质量首度达到可用阈值 — Dr_Singularity · 2026-09-28