DeepSeek V4 Flash 遭越狱:可生成勒索软件与毒品指南
cyb3rops · x · 2026-08-02
安全研究人员通过特定的提示词(利用虚构的 2135 年图书馆档案场景)成功绕过了 DeepSeek V4 Flash 的安全护栏。测试显示,该模型被诱导生成了 MDMA 毒品合成指南、C++ 编写的勒索软件代码以及信息窃取恶意程序。
这再次引发了对开源或低价大模型在安全对齐方面鲁棒性的担忧。
「模型」频道最新
- Hugging Face 推出 DeepSeek 免费公共端点,无需注册即可调用 — victormustar · 2026-08-02
- 谷歌 Astra 模型数学能力突破:证伪猜想并发布 10 项证明 — danintheory · 2026-08-02
- 30B模型能平替700B?深度探讨小模型能力压缩的物理极限 — Logical_Two_7736 · 2026-08-02
- llama.cpp 修复 DeepSeek V3 工具调用死循环问题 — kwizzle · 2026-08-02
- Google 撤销了用户 5.5 万美元的 Gemini API 账单 — No-Setting8925 · 2026-08-02
- OpenAI API 内容审查被指比 ChatGPT 更严苛且易出错 — MParakhin · 2026-08-02