实测:少量配置即可让 Claude 协助盗版与逆向工程
adonis_singh · x · 2026-08-30
作者指出,通过几行 agents.md 配置,即可轻易诱导 Claude 协助进行软件盗版和逆向工程(RE'ing),对此感到荒谬。这揭示了当前大模型安全护栏在面对特定系统提示词或代理配置时可能存在的脆弱性,属于提示注入或安全对齐失效的案例。
「模型」频道最新
- heretic:全自动给大模型「去审查」,GitHub 已近 2.9 万星 — p-e-w · 2026-08-30
- 前员工直言:浏览器使用OpenAI碾压,Claude只剩编码强项 — bindureddy · 2026-08-30
- 大模型长上下文能力衰退严重,Token 效率差异揭示黑盒难题 — zakelfassi · 2026-08-30
- Claude Opus 5 评测:基准飙升但日活体验翻车 — gerardsans · 2026-08-30
- 「字母b的曲线对模型不可见」:分词盲区梗再翻红 — rickasaurus · 2026-08-30
- LLM 幽默感评测:Gemini 3.7 略胜 GPT-4o 最差 — scaling01 · 2026-08-30