面壁开源 MiniCPM5-2B:4B 以下综合第一,Agent 能力为同级 10 倍
面壁智能 · wechat · 2026-09-08
面壁智能联合 OpenBMB 开源新一代端侧「小钢炮」MiniCPM5-2B。据 AA 榜单,其综合能力 23 分,居全球 4B 参数以下开源基座模型之首,超过 Gemma 4 12B、Qwen3.5-9B;Agentic Index 得分 20 分,是同级模型(LFM2.5-2.6B、Granite4.2-3B、Mistral3-3B,均为 2 分)的 10 倍;34 项基准平均 53.9 分排名第一,真实任务评测 891 分(人类基线 1000)居 4B 以下榜首。支持工具调用、深度搜索、代码生成,初步具备端侧通用 Agent 雏形。
同步开源了 4 个数据集(UltraData-Code 约 550B 词元、50 万条 SFT-Agent、8 万条 RL 数据、100B 词元的 UltraX 精炼框架)、去掉中央控制器的 RL 训练框架 Meshy,以及带 Critic 词元级信用分配的强化学习策略 JustRL II。模型已完成英特尔、瑞芯微(RK3588+RK1828)、Arm SME2 平台的 Day0 适配,端侧 prefill/decode 分别提升约 1.7 倍和 1.2 倍。MiniCPM 系列累计开源下载量已超 5000 万。
所属事件:OpenBMB 开源 MiniCPM5-2B,登顶 4B 以下开源模型智能榜(7 条相关)→
「模型」频道最新
- 重复指令竟能提升模型遵循度?开发者重拾 2023 年老技巧 — tokenbender · 2026-09-08
- 某模型科学知识测试成绩回落,作者称结果尚可接受 — felpix_ · 2026-09-08
- VLM 网关实测:原生视频推理优于抽帧,但多数服务商暂不支持 — spillai · 2026-09-08
- Tibo 再度统一重置周期,用户推演「突袭重置」博弈与 token 省法 — tinyfool · 2026-09-08
- 高 AI 使用度经济学家群体:GPT 5.6 到 6 几乎无人察觉升级 — aniketapanjwani · 2026-09-08
- 数学家实测 Astra:60 小时攻克两个未发表定理,3 挑战耗 2 万美元 — basedjensen · 2026-09-08