Kimi K3 在 ExploitBench 得分 32%,41 个样本无一达成 ACE

xeophon · x · 2026-07-24

这条帖子引用了 ExploitBench 上关于 Kimi K3 的漏洞利用开发评测结果。

关键信息包括:

配图里还列出了多款模型的横向比较,包括 GPT-5.5 (Codex)、Claude Mythos Preview、Claude Opus 4.7、Gemini 3.1 Pro Preview,并展示了 tier reach、cap coverage、mean cap、环境数、episode 数和花费等指标。

所属事件:Kimi K3 网络安全评测出炉:长链路能力提升但整体偏弱(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →