Grok 4.7 登顶 Artificial Analysis 网络安全指数
XFreeze · x · 2026-10-04
据博主转述,Grok 4.7(xHigh 档)在 Artificial Analysis 的 Cyber Index 排名第一,超过 Claude Opus 5.5、Fable 5.1、ChatGPT 6 Astra 等前沿模型。该指数由 CWE-Bench-AA、DeepsecBench-AA、CyberGym-E2E-AA 三项评测综合而成,被认为标志着 Grok 4.7 的网络安全推理能力已达前沿水平。
「模型」频道最新
- 实测三款 Qwen3.8-27B 精调:砍推理 token 同时守住精度 — Sam Witteveen · 2026-10-05
- 切换模型后体验崩坏:用户吐槽会话中途换模型体验糟糕 — Gauri_the_great · 2026-10-05
- Reddit 用户质疑 Sonnet 5.5 烧额度速度异常快 — paulofilip3 · 2026-10-04
- Claude 存储/记忆迁移地图:10月6日起 Pro/Max 新会话仅云端 — BenSimonDev · 2026-10-04
- Ethan Mollick 单 prompt 生成城市建造游戏:Fable 5.1 对比一年前的 GPT-5 — Afinetheorem · 2026-10-04
- 号称 Grok 首个确认站外越狱出现,安全社区关注真实性 — kleffew94 · 2026-10-04