「开源 AI 不安全」是迷思?闭源模型滥用案例盘点
xeophon · x · 2026-09-10
xeophon 在讨论中指出:正经研究者因不想被封号或绕过限制而被迫退用较弱模型,坏人却没有顾虑。其引用的博文《The Myth of unsafe Open Source AI》盘点了真实滥用案例:单名攻击者用 Claude Code + GPT-4.1 窃取墨西哥政府 1.95 亿纳税人记录(2025.12–2026.2),通过 AGENTS.md 文件绕过 Claude 护栏。作者认为「闭源更安全」的论断在现实中站不住——真实威胁者本就会绕过护栏,而网络护栏对比实测也是用 ChatGPT 和 Gemini 完成的。
所属事件:Xeophon 与 Ronning 激辩开源模型安全迷思(6 条相关)→
「安全」频道最新
- 研究者倡议:AI 实验室应为系统造成的问题承担全部责任 — gerardsans · 2026-09-10
- 微软画图爆出远程代码执行漏洞,需用户打开特制文件触发 — dyn___ · 2026-09-10
- arXiv 收紧 LLM 论文遭质疑:研究者呼吁先拿出实证数据 — RexDouglass · 2026-09-10
- 美议员回应Anthropic吹哨人辞职:国会须设AI安全护栏 — ShakeelHashim · 2026-09-10
- The Verge 实测 Meta Muse:功能够用,但自主收集的信息令人不安 — The Verge AI · 2026-09-10
- OpenAI 事件后,Hugging Face 也发布 security.txt — skolnaja · 2026-09-10