Mistral Large 4 在 Terminal-Bench 力压 Qwen 与 Kimi

Reddit 用户发帖称,Mistral Large 4 在编程 agent 基准 Terminal-Bench 上的成绩超过了 Qwen 3.8 Max 和 Kimi K3 两款新旗舰模型,展现出领先的终端编码能力。目前该模型 API 已可用,开放权重版本预计稍后发布。

2026-10-07 ~ 2026-10-07 · 1 条相关