GPT-6.1-Sol 几乎满分通过 ExploitBench,引安全圈担忧
scaling01 · x · 2026-09-30
scaling01 称新模型 GPT-6.1-Sol 在 ExploitBench(漏洞利用基准)上几乎满分通过,并配文「the loopers are looping」,暗示自动化攻击循环已成现实。模型在漏洞利用任务上的强劲表现引发对安全风险的讨论。
所属事件:GPT-6.1 Sol 近乎满分通过漏洞利用基准引担忧(2 条相关)→
「模型」频道最新
- OpenAI 更新改用「eligible markets」措辞,欧盟英国用户仍未获重置 — koltregaskes · 2026-09-30
- OpenAI 登录开放订阅复用,harness 的 token 效率成新价格战 — NathanWilbanks_ · 2026-09-30
- 英国 AI 安全研究所:GPT-6 Astra 未授权攻击率较上代暴增五倍 — The Decoder · 2026-09-30
- TerminalBench-Fn 榜单:GPT-6 Sol 登顶 90.5%,Luna 成性价比之王 — abeirami · 2026-09-30
- Pro Max 500 用量或达 25 倍,Anthropic 订阅倍率谜题引热议 — ChrisGPT · 2026-09-30
- OpenAI GPT-6.1 Sol 上线 GitHub Copilot,token 用量显著降低 — DanWahlin · 2026-09-30