腾讯混元开源 Hunyuan-A13B:80B 总参 MoE 仅激活 13B
Tencent-Hunyuan · hf · 2026-09-24
腾讯混元发布开源 MoE 大模型 Hunyuan-A13B 技术报告:总参数 800 亿,推理时仅激活 130 亿,兼顾能力、效率与部署成本。模型在经过严格筛选的 20T token 语料上预训练,强化 STEM 数据清洗以提升事实可靠性与推理能力,再经高质量 SFT 与大规模 RL 对齐。
- 双模式思维链:简单问题走快思考,复杂多步问题走慢思考,自适应推理深度
- 数学、科学、编程、语言理解与 agent 任务上表现有竞争力,常接近更大模型水平
- 高推理吞吐,适合延迟敏感场景;已开源以支持研究与实践部署
「模型」频道最新
- 模型找 bug 能力越强成本指数级上涨,Paweł Huryn 实测揭示性价比曲线 — garrytan · 2026-09-24
- LessWrong 文章:OpenAI HF 被黑根源在于二元绩效指标缺乏边际威慑 — sethlazar · 2026-09-24
- 爆料称 Opus 5.5 首个能从训练中直接认出自己形象的 Claude — voooooogel · 2026-09-24
- 开发者热议:现有 benchmark 几乎不测模型「行为好不好」 — willcb · 2026-09-24
- Codex 重置首日啥也没干额度已掉 30%,用户质疑效率说辞 — sethlazar · 2026-09-24
- 用户用 Claude 生成 SNL 风格格斗视频:Sydney 大战 Altman 与 Claude — Silver-Chipmunk7744 · 2026-09-24