Anthropic 威胁报告:受军方资助研究员绕开 Claude 转投竞品模型
ns123abc · x · 2026-09-11
Anthropic 发布 2026 年 9 月威胁情报报告,披露 2025 年 12 月至 2026 年 8 月间在七大危害领域(网络攻击、影响力行动、监控、诈骗、生物滥用、常规武器、非法蒸馏)识别并阻断的 Claude 恶意使用案例,涉及疑似国家支持组织、犯罪团伙、商业间谍软件厂商等。除一起非法蒸馏外,均未涉及 Fable/Mythos 级模型。
推文作者引用报告点出关键案例:一名获军方研究机构资助的研究员利用 Claude 进行基孔肯雅病毒的增益功能研究(面向传播性与免疫逃逸),被 Claude 拒绝的请求被成功转投到一家竞品更宽松的模型上——印证报告标题所言「复杂攻击不再需要复杂攻击者」。
所属事件:Anthropic 发布迄今最详细威胁情报报告(16 条相关)→
「模型」频道最新
- 实测对比:Astra 越野语义理解远胜 SAM3,识别球员角色 42/45 — TheMoonMidas · 2026-09-11
- NVIDIA Nemotron 3 Embed 8B 登顶 Perplexity 新基准 Q2D-Web — JFPuget · 2026-09-11
- 第三方基准称 GPT-6 Astra 抗体成药性预测领先各家前沿模型 — gdb · 2026-09-11
- 爆料称 Grok 4.7 或于明日发布,推迟则顺延至下周初 — mark_k · 2026-09-11
- 细节:K3 在视觉编码器上与上代有大差异 — stochasticchasm · 2026-09-11
- OpenCompass 发布 SWE-Bench Pro Verified:修复刷分问题后前沿模型分数大降 — _akhaliq · 2026-09-11