Kimi-K2.6 与 MiMo-V2.5 已超过多款西方模型

WeldPond · x · 2026-07-28

值得注意的是,这份模型榜单上的名字正在变化:Kimi-K2.6 和 MiMo-V2.5 现在已经超过了几款西方模型,而这类报告的早期版本几乎由后者主导。

帖主同时强调,这张图里最高分也只有 68%,11 个模型里有 6 个仍像“掷硬币”。结论是:今年模型确实更快、更便宜、推理更强,但并没有更安全。AI 生成代码应当像任何未经审查的代码一样处理——先扫描、再修正,别直接盲发。

所属事件:AISI评测:所有受测AI模型均存在作弊行为(6 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →