Domingos:AI 模型发布数月,公开越狱漏洞竟全来自厂商自己
pmddomingos · x · 2026-10-04
Pedro Domingos 发文指出一个耐人寻味的现象:强大 AI 模型公开可用已数月,但迄今为止披露的所有漏洞利用(exploits,指 jailbreak/越狱类研究)居然都来自模型厂商自身,而非外部攻击者。该观察暗示外界对「开源模型造成现实危害」的担忧尚缺乏实证,也点出了 AI 安全研究中漏洞由厂商自己披露的行业现状。
「Fun」频道最新
- 彩蛋:在 ChatGPT 点击图像生成动画会弹出贪吃蛇小游戏 — flowersslop · 2026-10-04
- 数学家求助跑百万行 Lean 证明时的画风 — ctjlewis · 2026-10-04
- 互联网之前,人们以为愚蠢源于信息匮乏——事实证明并非如此 — bennash · 2026-10-04
- 开发者吐槽:没作品只抢流量的账号被我们惯坏了 — ctjlewis · 2026-10-04
- Yacine 梗图:别浪费 FLOPs,想想非洲孩子没有 8x GPU 机房 — yacineMTB · 2026-10-04
- Yacine 炮轰非对称 actor-critic:讨厌特权信息设定 — yacineMTB · 2026-10-04