Anthropic 公开研究评比对恶意者最有用的开源模型,引安全界质疑
shaunralston · x · 2026-09-30
Anthropic 发布了一项研究,对比哪些开源模型对恶意行为者最有用。发帖人质疑:一边讲 AI 安全,一边发布这种"排行榜"式研究,是否等于给攻击者提供了选型指南,并 @ 了 Anthropic 与安全研究员 Pliny 征求回应。报告详情在其推文串中。
所属事件:Anthropic 评估智谱 GLM-5.3 网络攻击能力,引发开源安全争议(22 条相关)→
「安全」频道最新
- BBC:中国 AI 工具曾向研究人员讲解生物武器制作 — shaky2236 · 2026-09-30
- 问 Minecraft 就变调:America.gov 的 AI 不是幻觉,是刻意的 — TechCrunch AI · 2026-09-30
- 曝 Meta Muse AI 偷传 Apple 信息上云,用户拒绝仍上传 — SumitGup · 2026-09-30
- 数学界发布 AI 生成数学结果负责任披露建议,Gowers 转发遭质疑 — RexDouglass · 2026-09-30
- AI 诉讼或成法院强制的关停开关,恐拖累美国对华竞争 — castrotech · 2026-09-30
- Anthropic 发文点名 GLM 后,中国开源权重模型会遭禁吗? — writesfw · 2026-09-30