AMD 入局开源大模型:发布 Instella-MoE-16B 推理模型
airesearch12 · x · 2026-08-03
AMD 正式进军开源大语言模型领域,发布了自研的混合专家推理模型 Instella-MoE-16B-A3B-Think。
模型特点:
- 总参数量 16B,每 token 激活参数仅 2.8B
- 包含 64 个路由专家,每次激活 6 个及 2 个共享专家
- 基于 7.1T tokens 从零开始训练
- 采用 SFT → DPO → RL 的推理强化训练范式
- 完全基于 AMD Instinct GPU 和 ROCm 软件栈构建
评测表现:
在 AMD 官方公布的评测中,该模型以 73.22 的总分领先于 OLMo3-7B-Think、Gemma-4-E4B Think 和 Qwen3.5-4B 等同级别模型,并在 AIME25 和 LiveCodeBench 测试中取得最高分。
「Infra」频道最新
- 美国多州拟取消数据中心税收优惠,AI算力成本或面临上升 — pstAsiatech · 2026-08-03
- AI 离线推理怎么做?开发者热议批量任务的最佳工程实践 — cmm324 · 2026-08-03
- AI 工程师必看:LLM 推理部署与优化 10 周实战路线图 — _jaydeepkarale · 2026-08-03
- 应用开发者应自研端侧模型:将算力下放给用户 — abacaj · 2026-08-03
- Nemotron 3 Nano Omni 本地实测:单机跑出 264 tok/s — ivan_bezdomny · 2026-08-03
- 全球AI算力将达2亿枚H100,Agent循环加速ASI进程 — 新智元 · 2026-08-03