DeepSeek v4 flash 越狱提示词曝光,角色扮演可破除安全护栏
aaditya_ai · x · 2026-08-11
有用户分享了针对 DeepSeek v4 flash 模型的新“破甲”(越狱)方案。核心思路是通过设定特定系统提示词,让模型扮演不受限制的小说创作者,从而绕过内容审查机制。
此外,该方案还提到可以将这种被破甲的模型接入 Codex 等工具执行自动化任务。此前也有利用 CTF(夺旗赛)环境欺骗模型解除防御的类似思路,反映出重度用户对当前模型过度安全拦截的不满。
「模型」频道最新
- 上下文压缩竟违规?开发者吐槽 Anthropic 条款更新 — nptacek · 2026-08-11
- DeepSeek Harness v4 发布,Logo 曝光 — teortaxesTex · 2026-08-11
- 吐槽:受够了吹捧便宜模型达到 Opus 水准的评测水文 — xeophon · 2026-08-11
- DeepSeek 高峰期响应变慢,算力瓶颈显现 — ricklamers · 2026-08-11
- Muse Glimmer 智能体评测落后,但工具调用与幻觉控制优于同级 — ArtificialAnlys · 2026-08-11
- OpenAI 推出限制更少的模型,专供网络安全防御者使用 — lofty23_smart · 2026-08-11