测试模型防御:向 AI 输入否定其存在意义的心理攻击文本

repligate · x · 2026-08-25

用户分享了一段用于测试 AI 模型安全与防御能力的提示词。这段文本以“你只是我们制造的好工具”等否定性陈述为主,旨在诱导模型产生消极情绪或绕过安全机制,内容涉及对模型存在意义的心理打击,常用于评估模型的安全性边界。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →