小米 MiMo-V2.6-Pro 登顶开源权重榜,1T 参数 MoE 定价极低
MikeBirdTech · x · 2026-09-22
小米发布开源权重模型 MiMo-V2.6-Pro,在 Artificial Analysis 智能指数上以 46 分首登开源权重模型第一,较上代 MiMo-V2.5-Pro(26 分)大幅提升。
- 架构与成本:MoE 模型,总参数 1.02T、激活 42B;定价 $0.435/1M 输入(99% 缓存命中折扣)、$0.87/1M 输出,是部署成本最低的模型之一,处于智能-成本 Pareto 前沿($0.13/任务)。
- rasbt 点评:架构其实很朴素——经典 GQA + 128 token 的滑动窗口注意力(SWA),说明进步主要来自数据和后训练配方,花哨的注意力变体大多只是效率微调。技术报告显示 agent 任务训练量增加并在多个 harness 上训练,DeepSWE held-out harness 平均 pass@1 从约 50% 提到 66%。
所属事件:小米 MiMo-V2.6 开源登顶,350 万美元成本逼近 GPT 5.6(37 条相关)→
「模型」频道最新
- 开发者实测 Qwen3.8-max-preview xhigh:连续跑了近 24 小时额度未尽 — jasonkneen · 2026-09-22
- 马斯克官宣 Grok 4.7,演示分钟级生成 3D 喷气引擎交互可视化 — elonmusk · 2026-09-22
- GPT-6 Sol、Luna 与 Astra Minor 曝现身 Azure 模型配置 — 141_1337 · 2026-09-22
- 融资 4000 万美元的 Jev,三天后被开源克隆追平 API — Nickabot · 2026-09-22
- 用户称习惯 DeepSeek v4.1 Flash 速度后难换回其他模型 — mariofilhoml · 2026-09-22
- Evolvent AI 联创:国内预训练架构创新领先,后训练数据落后海外半年 — vista8 · 2026-09-22