韩国Motif发布314B MoE开源模型,性能比肩DeepSeek V4 Pro
eliebakouch · x · 2026-07-21
韩国公司Motif发布Motif 2.6B技术报告,实际为13B激活314B总参数的MoE模型,性能与Minimax M3和DeepSeek V4 Pro相当。模型采用差异化注意力(GDLA)、每专家激活函数polynorm、改进的mHC等创新。训练使用2.5T token,采用数据混合调度和WSD学习率调度。微调数据使用EvolKit和数据集融合。
所属事件:韩国Motif发布314B参数MoE模型Motif-3 Beta(4 条相关)→
「模型」频道最新
- Grok 4.5 在 Cursor 里免费开放使用 — mark_k · 2026-07-21
- GPT 在数学题上常收敛到相似的近似思路 — yacineMTB · 2026-07-21
- Eno Reyes:模型蒸馏基本已经不可阻挡 — LangChain · 2026-07-21
- Sakana 用多扩散模型协作提升编程和数学表现 — SakanaAILabs · 2026-07-21
- OpenAI 黑客松项目卡住了:Codex 语音吃力,Claude 反而先诊断出问题 — ColleenMBrady · 2026-07-21
- Kimi K3 精准落在中国两年 AI 能力趋势线上 — peterwildeford · 2026-07-21