AISI更新开源模型安全差距

Outside-Iron-8242 · reddit · 2026-07-18

AISI 的最新结果显示,GPT-5.6 Sol 在他们的 cyber challenge 上超过了 Mythos 5。

同时,AISI 还把 GLM-5.2 和 DeepSeek V4-Pro 加入了评测范围,并指出:领先的开源权重模型与闭源前沿模型之间的差距,已从 2025 年大部分时间的 6–10 个月 缩小到现在大约 4–7 个月。

AISI 还表示,K3 还没被纳入测试,后续结果可能会进一步改变这一差距判断。

所属事件:AISI称开源模型缩小网络安全差距(6 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →