研究者尝试用被降智的模型挖安全漏洞
DanielLockyer · x · 2026-09-25
DanielLockyer 表示正在尝试让已被「nerfed」(能力受限)的 AI 模型进行安全漏洞研究,附带演示链接。内容展示了如何利用当前版本模型做安全挖掘的实践。
「安全」频道最新
- Index Ventures 合伙人:AI 攻击更快更便宜,人机协同防御模式或将失效 — RebeccaBellan · 2026-09-25
- Bengio 在联合国安理会警告:失控前沿 AI 智能体的空前威胁 — AnnaCiaunica · 2026-09-25
- 把 AI 接上断头台做实验:模型差点亲手「处决」用户 — wild_crazy_ideas · 2026-09-25
- 911 调度员开源 Arcaeon:给 AI Agent 日志上「防篡改锁」 — Educational_South_20 · 2026-09-25
- 曝 OpenAI 数周内预览 GPT-6 Cyber,将推首个网络安全专用产品 — jeremyakahn · 2026-09-25
- 学者开设「AI 与法律」课程,先用匿名投票摸底学生观点 — technollama · 2026-09-25