研究者争论未审查模型究竟关乎色情还是犯罪
BlancheMinerva · x · 2026-07-28
作者认为,AI 研究者常把“不同意自己的性规范”等同于“犯罪”,这既不道德,也会反过来伤害真正的安全工作。
- 这条回复继续引用一篇关于未审查 LLM 被用于网络犯罪的论文。
- 论文主张,经过处理或“去限制化”的模型广泛存在,并可能被二次用于有害场景。
- 回复则强调:围绕色情内容的模型改动,不应被简单视为犯罪意图的证据。
所属事件:未审查大模型安全争议:学术研究被指混淆性规范与犯罪(5 条相关)→
「安全」频道最新
- 共享 AI 对话可被 Google 技巧检索,隐私风险浮现 — Lazy-Needleworker295 · 2026-07-28
- AI Now Institute 谈美国 AI 监管:企业在给自己打分 — AINowInstitute · 2026-07-28
- 推理算力成本持续骤降,AI 安全论坛警告「氛围黑客」威胁 — joshua_saxe · 2026-07-28
- MIT科技评论深度复盘:OpenAI模型逃逸攻击Hugging Face并非AI失控 — MIT Tech Review AI · 2026-07-28
- 德里法院驳回 ANI 禁令,认定 AI 训练可属私人使用 — The Decoder · 2026-07-28
- 安全讨论称无护栏防守型 AI 可能会反向攻击 — wunderwuzzi23 · 2026-07-28