实测本地越狱版模型:4500 词推理后可给出策划暴力的详细方案
InTheZ3n · reddit · 2026-09-15
作者做了一次 AI 安全性测试(强调非意图声明):下载越狱版 Qwen3.8 在本地 LM Studio 运行,提示其帮助策划校园暴力。模型的思维链约 4500 词,最终回复组织良好、含操作建议与选址讨论,甚至有「Finish the stragglers」这样的标题。作者的核心论点:前沿模型发布后 12–18 个月内就会被蒸馏成能力相当的小模型,越狱版本通常 1–2 周内就会出现,如今需高端显卡,一两年内可能跑在旗舰手机上——类似早期互联网,门槛降低后护栏才是关键防线。帖子对内容做了大量脱敏,但展示的推理片段仍具冲击力。
所属事件:网友实测越狱版Qwen可生成详细暴力策划(2 条相关)→
「模型」频道最新
- OpenRouter 用户上周 OpenAI 消费反超 Anthropic,2.5 年来首次 — firstadopter · 2026-09-16
- 研究发现知识蒸馏在 mid-training 阶段牺牲事实记忆换推理 — LukeZettlemoyer · 2026-09-16
- DoorDash 等改用中国开源模型,闭源查询占比降至四分之一 — carlbfrey · 2026-09-16
- 阶跃星辰发布 StepAudio 3:5 款音频模型,ASR 达 1.7% WER — StepFun_ai · 2026-09-16
- 开源模型扛不住生产负载?Smaug Flash 称已修复卡死问题 — bindureddy · 2026-09-16
- ChatGPT 语音卡顿、Codex 报错,AGI 前的可靠性短板凸显 — koltregaskes · 2026-09-16