英美安全机构评测称 Kimi K3 落后美国前沿模型
英国人工智能安全研究所(AISI)与美国 NIST 下属的 CAISI 联合对月之暗面的 Kimi K3 模型进行了初步网络安全能力评估。测试结果显示,Kimi K3 在网络安全相关任务中的表现显著低于美国领先的前沿模型。
已确认
根据相关机构及测试转述信息,美英政府测试发现 Kimi K3 的表现“显著低于”美国前沿模型。在具体的网络安全能力评估中,该模型在网络攻击等 cyber 相关任务上远逊于最新一代的前沿模型。例如在 ExploitBench 测试中,作为对比的前沿模型 Mythos Preview 有 18/41 个任务能发展到任意代码执行(ACE),而 Kimi K3 整体处于落后状态。此次评估为初步测试,且测试推进速度较快。
为什么重要
这是官方安全机构对国产出海大模型进行的具体能力检验。评估结果客观指出了 Kimi K3 在前沿网络安全攻防能力上与美国顶尖模型存在的差距,为业界了解该模型的安全与攻击能力边界提供了权威参考。
2026-07-24 ~ 2026-07-24 · 8 条相关
一手来源
- 英国 AISI 评测:Kimi K3 网络安全能力远逊前沿模型 — socoolandawesome ·
- UK AISI/CAISI 评估显示 Kimi K3 落后前沿网络攻击模型 — ShakeelHashim ·
- 【源头】英国 AISI 评测:Kimi K3 网络安全能力远逊前沿模型 — socoolandawesome · 2026-07-24
- Kimi K3 在初步网络安全评测中落后美国前沿模型 — HZoete · 2026-07-24
- 【源头】UK AISI/CAISI 评估显示 Kimi K3 落后前沿网络攻击模型 — ShakeelHashim · 2026-07-24
- 英美安全机构对 Kimi K3 展开网络安全能力初步评估 — HZoete · 2026-07-24
- CAISI 报告称 Kimi K3 仍落后于美国前沿模型 — AravSrinivas · 2026-07-24
- 美英政府测试称 Kimi K3 明显落后美国前沿模型 — Polymarket · 2026-07-24
- CAISI 报告称 Kimi K3 领跑开源权重模型,但仍落后美国前沿模型 — mattsheehan88 · 2026-07-24
- 英国评估称 Kimi K3 的网络能力落后美国前沿模型 — BlackHC · 2026-07-24