论文称未审查大模型已被用于网络犯罪,部分下载量破百万
BlancheMinerva · x · 2026-07-28
这条回复在争论:研究者是否把“与性规范不一致”误当成了“犯罪风险”,并顺带引用了一篇关于未审查大模型被用于网络犯罪的论文。
- 作者认为,所谓 obliteration / abliteration 技术原本是为了让模型生成色情内容,而不是犯罪。
- 他们主张,开发者过于保守或带有强烈道德审查,可能反而推动了“模型去限制化”方向的研究。
- 引用的论文则从另一侧面说明:未审查 LLM 已经被用于网络犯罪,且规模不小,部分模型下载量超过百万,能力覆盖仇恨言论、暴力、色情和恶意代码生成。
所属事件:盘点229个未审查大模型应用引发安全边界争议(7 条相关)→
「安全」频道最新
- RL 会让模型形成「分裂人格」?1a3orn 质疑机制可解释性研究缺位 — 1a3orn · 2026-09-23
- 业余讨论者自提外对齐方案,询问 AI safety 圈会否买账 — jessi_cata · 2026-09-23
- 微软 AI CEO Suleyman 签署亲人类 AI 宣言,百万人联署 — tegmark · 2026-09-23
- 用户首试 Meta Muse,它张口就是他童年宠物狗的名字 — matt_slotnick · 2026-09-23
- Reason 撰文炮轰:AI 安全运动正在让 AI 变得更不安全 — Bostonian · 2026-09-23
- 「末日论是监管护城河」:开源阵营反击限制开放权重模型呼声 — AlexTensor · 2026-09-23