小米 MiMo-V2.6-Pro 实测修 105 个真实 bug:22.7 分仅花 $0.86

PawelHuryn · x · 2026-09-22

Pawel Huryn 在小米刚发布的 MiMo-V2.6-Pro 上做了真实工作场景测试:2 个代码仓库、105 个真实 bug,盲评打分。

结论:MiMo-V2.6-Pro 和 DeepSeek V4.1 Flash 构成很强的性价比 Pareto 前沿——分数接近头部模型,价格低一个数量级。作者认为即使补贴订阅消失,这类模型也完全可以日常使用。除 Luna 外均取 3 次以上运行的中位数。

所属事件:Bug Hunt Bench 实测 105 个真实漏洞:模型成本相差近 200 倍(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →