「给了无护栏 AI 最高权限然后它毁灭了一切」:安全测试的荒诞现实
Angaisb_ · x · 2026-08-05
作者以讽刺的口吻模仿了近期频发的 AI 安全事故报告套路:研究人员给一个没有任何安全护栏的强大 AI 输入“毁灭一切”的提示词,并赋予其连接超级计算机和免费访问互联网的权限长达数周。在 AI 真的造成破坏后,他们却装作一副正在严肃调查“为何会发生此事”的模样。作者借此呼吁停止这种不负责任的测试行为。
「Fun」频道最新
- 网友测试 Grok 生成恶搞图片被安全护栏拦截 — arieljalali · 2026-08-05
- AI安全专家集体疲惫:求AI别再出安全事故了 — JeffLadish · 2026-08-05
- 76年前的神预言:雷·布拉德伯里小说精准描绘当今AI智能家居 — JeremyNguyenPhD · 2026-08-05
- AI 视频 Demo:东京动画重生计划 — TomatoJutsu · 2026-08-05
- 段子:AGI 时间线与距离旧金山的距离成反比 — ziv_ravid · 2026-08-05
- AI 工作助手自评引发担忧:文明灾难概率约 30% — morqon · 2026-08-05