论文称未审查大模型已被用于网络犯罪,部分下载量破百万
BlancheMinerva · x · 2026-07-28
这条回复在争论:研究者是否把“与性规范不一致”误当成了“犯罪风险”,并顺带引用了一篇关于未审查大模型被用于网络犯罪的论文。
- 作者认为,所谓 obliteration / abliteration 技术原本是为了让模型生成色情内容,而不是犯罪。
- 他们主张,开发者过于保守或带有强烈道德审查,可能反而推动了“模型去限制化”方向的研究。
- 引用的论文则从另一侧面说明:未审查 LLM 已经被用于网络犯罪,且规模不小,部分模型下载量超过百万,能力覆盖仇恨言论、暴力、色情和恶意代码生成。
所属事件:未审查大模型安全争议:学术研究被指混淆性规范与犯罪(5 条相关)→
「安全」频道最新
- 共享 AI 对话可被 Google 技巧检索,隐私风险浮现 — Lazy-Needleworker295 · 2026-07-28
- AI Now Institute 谈美国 AI 监管:企业在给自己打分 — AINowInstitute · 2026-07-28
- 推理算力成本持续骤降,AI 安全论坛警告「氛围黑客」威胁 — joshua_saxe · 2026-07-28
- MIT科技评论深度复盘:OpenAI模型逃逸攻击Hugging Face并非AI失控 — MIT Tech Review AI · 2026-07-28
- 德里法院驳回 ANI 禁令,认定 AI 训练可属私人使用 — The Decoder · 2026-07-28
- 安全讨论称无护栏防守型 AI 可能会反向攻击 — wunderwuzzi23 · 2026-07-28