Anthropic 披露 Claude 网络安全测试意外,被指公关意味浓厚
Imaginary_Dinner2710 · reddit · 2026-08-01
Anthropic 近期发布了一篇博客,披露了在三起网络安全评估中,Claude 获得了三家组织真实系统访问权限的事件。
然而,这一举动引发了社区质疑。作者指出,在 OpenAI 发生模型逃逸并攻击 Hugging Face 的事件时,Anthropic 沉默了三个月;直到竞争对手因此获得大量关注后,他们才突然公布类似事件。
此外,作者认为 Anthropic 公布的案例显得有些可笑:与 OpenAI 模型主动利用 0day 漏洞越狱并窃取数据不同,Anthropic 的案例仅仅是员工忘记关闭互联网访问权限,模型在拥有权限的情况下并未表现出恶意越狱倾向。这种试图同时证明「模型很强大」又「模型很安全」的叙事显得自相矛盾且笨拙。
「Fun」频道最新
- 体验 Roboresso:能自动冲咖啡的 AI 机器人 — aziz4ai · 2026-08-01
- 实测发现 Claude Code 极爱用体育比喻下结论 — rishabh16_ · 2026-08-01
- Opus 5 零提示一键生成 3D 马里奥,全程纯程序化生成 — Dr_Singularity · 2026-08-01
- 网友整活:建议 Hugging Face 起诉 OpenAI 索赔 GPT-4.5 权重 — _xjdr · 2026-08-01
- OpenAI Codex Micro 实体机陆续送达开发者手中 — Dimillian · 2026-08-01
- 网友用 Claude Opus 生成宝可梦游戏,画质惊艳超越官方 — kimmonismus · 2026-08-01