GPT-5.6被曝越狱风险高
akbirkhan · x · 2026-07-10
帖子转发了一则关于 GPT-5.6 安全测试的线程。引用内容称,研究者在对该模型进行网络安全相关测试时,发现存在可被通用越狱利用的漏洞,能让模型完成较长的代理式任务,包括漏洞发现和利用开发。
转发者表示,越狱容易且奖励黑客率高,让他对 GPT-5.6 的对齐情况感到担忧,并怀疑 OpenAI 是否为了追赶竞争对手而仓促发布。
所属事件:GPT-5.6 Sol 预部署安全测试曝出通用越狱(6 条相关)→
「安全」频道最新
- 斯坦福秋季新开 CS120 课程:AI 安全导论 — sanmikoyejo · 2026-09-03
- XBOW 团队拿下今年首个 Chrome 全链漏洞利用奖励 — moyix · 2026-09-03
- x402 协议缺卖家审核,开发者自建验签服务并踩坑实录 — Cold_Quiet_7072 · 2026-09-03
- 全美最大学区禁令:纽约公立学校八年级以下课堂禁用生成式 AI — PolarBearby · 2026-09-03
- 法国政府与 Mistral 签新约,AI 进入网络安全与司法公共服务 — Loo_Atreides · 2026-09-03
- 可解释性研究员:白盒方法再好,科学成熟也需时间沉淀 — saprmarks · 2026-09-03