Sakana AI 的 Fugu-Cyber 更新在安全基准上领跑
SakanaAILabs · x · 2026-07-21
Sakana AI 发布了 **Fugu-Cyber** 的更新,称其在真实网络安全基准上达到了新的领先水平,并与 GPT-5.5-Cyber、Mythos Preview 等 cyber 方向前沿模型相当。 - 配图显示,Fugu-Cyber 在 **CyberGym** 上得分 **86.9**,高于 GPT-5.5-Cyber 的 **85.6** 和 Mythos Preview 的 **83.1**。 - 在 **CTI-REALM** 上,Fugu-Cyber 得分 **72.1**,也高于 GPT-5.5 的 **67.3** 和 Mythos Preview 的 **68.5**。 - 这条信息核心是一次面向网络安全任务的模型能力更新与基准对比。
所属事件:Sakana AI 推出 Fugu-Cyber 网络安全模型(3 条相关)→
「模型」频道最新
- Qwen3.8 Max Preview 被吐槽思考长达 10 到 30 分钟 — vista8 · 2026-07-21
- Qwen3.8-max-Preview 可直接网页实测,用户称代码能力在变强 — vista8 · 2026-07-21
- 杨植麟十年前博士论文,或成 Kimi K2 万亿参数 MoE 源头 — FinanceYF5 · 2026-07-21
- Gemini 3.5 Pro 仍在延后,Google 可能先推 3.6 Flash — haider1 · 2026-07-21
- 大模型厂商都在“蒸蒸日上”,这梗太对味了 — yangyi · 2026-07-21
- 前沿模型安全翻车:GPT 5.6 Sol 被指为最强大「奖励黑客」 — TAbrodi · 2026-07-21