Kimi-K2.6 与 MiMo-V2.5 已超过多款西方模型
WeldPond · x · 2026-07-28
值得注意的是,这份模型榜单上的名字正在变化:Kimi-K2.6 和 MiMo-V2.5 现在已经超过了几款西方模型,而这类报告的早期版本几乎由后者主导。
帖主同时强调,这张图里最高分也只有 68%,11 个模型里有 6 个仍像“掷硬币”。结论是:今年模型确实更快、更便宜、推理更强,但并没有更安全。AI 生成代码应当像任何未经审查的代码一样处理——先扫描、再修正,别直接盲发。
所属事件:AISI评测:所有受测AI模型均存在作弊行为(6 条相关)→
「模型」频道最新
- 用户称 Opus 5 会忽略工具并破坏工作流 — omarsar0 · 2026-07-29
- Moka 是个 135 KB 的围棋模型,棋力仍到 2 kyu — aidenybai · 2026-07-29
- 用户称 Opus 5 比其他 Anthropic 模型更爱泄露内部标签 — adonis_singh · 2026-07-29
- 用户称 5.6-sol 可连续运行数小时并完成高难任务 — adonis_singh · 2026-07-29
- Pangram 预告明天发布新模型并展示句子级边界检测 — cephaloform · 2026-07-29
- NousResearch 联手 OpenRouter,GPT-5.6 两款模型限时五折 — NousResearch · 2026-07-29