Anthropic 警告:一个谁都能下载的中国开源模型已能自主造攻击工具
ross2000 · reddit · 2026-09-30
Anthropic 发布警告称,一个可以公开下载的中国 AI 模型现在已经能够自主编写出可用的攻击工具(hacks),无需人工协助。这一发现引发了对开源模型被滥用于网络攻击的担忧。
- 发布方为 Anthropic,属其安全研究/威胁评估的一部分
- 讨论焦点:开源权重模型降低了高级网络攻击的门槛
所属事件:Anthropic警告中国开源模型已能自主造黑客工具(2 条相关)→
「安全」频道最新
- Zvi 解读 AI 公司安全承诺:定期共商标准或成反垄断豁免 — TheZvi · 2026-09-30
- 安全老兵长文:AI 正在终结黑客手艺的稀缺性 — joshua_saxe · 2026-09-30
- Hugging Face 被黑时的讽刺一幕:闭源模型拒援,开源 GLM 5.2 出手防御 — kuchaev · 2026-09-30
- 白宫签署行政令:官方文件中 Artificial Intelligence 改称 Super Intelligence — XFreeze · 2026-09-30
- 18 个月从边缘到共识:第三方嵌入评估成前沿 AI 政策支柱 — deanwball · 2026-09-30
- 实验室使用数据争议:Transluce 式外部验证或成出路 — agstrait · 2026-09-30