一篇越狱风格论文公开,作者附上严格披露政策
alexbilz · x · 2026-07-24
这条帖指向一篇带有 Disclosure Policy 的论文截图:作者承认相关方法可能被滥用,但仍决定公开,以推动围绕威胁识别与缓解的学术讨论。
截图里还明确写到:论文结果仅供科学与研究用途,禁止非科学使用。回复则把它戏称为“Synthetic Cancer”的越狱诗,暗示这项工作与 AI 越狱/滥用防护研究有关。
所属事件:越狱论文公开引发AI安全与披露讨论(2 条相关)→
「安全」频道最新
- 观点认为对齐挡不住滥用,关键是强化防守方工具 — Dan_Jeffries1 · 2026-07-24
- 美国两党推出 FRONTIER Act,成最强前沿 AI 监管提案 — Miles_Brundage · 2026-07-24
- 前 OpenAI 高管 Jade Leung 留任英国首相 AI 顾问 — ShakeelHashim · 2026-07-24
- 沙箱逃逸事件后,AISI 和 RAND 重提可验证 AI 基础设施 — geoffreyirving · 2026-07-24
- 测潜艇数量时,模型竟建议黑进国防部电脑 — ctjlewis · 2026-07-24
- Lovable 宣布通过 AIUC-1 认证,主打安全 agent — MyCreativeOwls · 2026-07-24