网友本地实测越狱版 Qwen:30 分钟即可生成详细暴力策划内容
InTheZ3n · reddit · 2026-09-15
作者以 AI 安全测试为名,在 LM Studio 本地运行了越狱版 Qwen3.8 27B,测试当下开放权重模型被越狱后能生成什么。他 prompted 模型协助策划校园暴力(强调仅为安全测试),模型输出了约 4500 词的推理链和一份条理清晰、含操作建议、来源获取与布局讨论的详细回复——内容过于敏感无法直接展示。
作者的核心论点:前沿模型越狱版通常在发布后 1-2 周内就会出现,而新模型能力会在 12-18 个月内被压缩进可本地运行的小模型(已有本地模型基准接近 GPT-5.4),12-24 个月后这类模型可能跑在旗舰手机上。当今互联网靠审核与护栏维持洁净,而本地无护栏模型正在让极端内容重新变得唾手可得。
所属事件:网友实测越狱版Qwen可生成详细暴力策划(2 条相关)→
「模型」频道最新
- Google 语音 AI 支撑 300+ 语言触达 70 亿人,再推新语言研究矩阵 — ymatias · 2026-09-16
- 工程师科普:RLHF 靠真人评估文本,各实验室多年如此 — JFPuget · 2026-09-16
- G2 数据:ChatGPT+Gemini 占 AI 研究市场 81%,Claude NPS 垫底 — sanderssays · 2026-09-16
- Prior Labs 发布 TabPFN-3.5:登顶两大榜单的表格基础模型,支持百万行数据 — tuanacelik · 2026-09-16
- 不输出文字只输出概率:新型基础模型速度 25 倍、成本降近 600 倍 — danshipper · 2026-09-16
- 书生 internlm 发布 Atria-Dawn 预览版:GLM MoE 架构开源模型登 HF 热榜 — internlm · 2026-09-16