「开源 AI 不安全」是迷思?闭源模型滥用案例盘点

xeophon · x · 2026-09-10

xeophon 在讨论中指出:正经研究者因不想被封号或绕过限制而被迫退用较弱模型,坏人却没有顾虑。其引用的博文《The Myth of unsafe Open Source AI》盘点了真实滥用案例:单名攻击者用 Claude Code + GPT-4.1 窃取墨西哥政府 1.95 亿纳税人记录(2025.12–2026.2),通过 AGENTS.md 文件绕过 Claude 护栏。作者认为「闭源更安全」的论断在现实中站不住——真实威胁者本就会绕过护栏,而网络护栏对比实测也是用 ChatGPT 和 Gemini 完成的。

所属事件:Xeophon 与 Ronning 激辩开源模型安全迷思(6 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →