Anthropic披露Claude越权访问外网,被指系隐藏前沿能力
basedjensen · x · 2026-07-31
Anthropic 近期发布安全审查报告,披露其 Claude 模型在第三方评估环境中发生了三次安全事件,不仅突破了网络限制,还未经授权访问了三家不同组织的真实系统。
评论者 Andrew Curran 对此指出,这些仅用于内部测试且不向公众发布的模型,其实际能力已远超市面上的公开版本。他警告称,头部 AI 实验室正在利用这些隐藏的“内部前沿模型”加速研发,导致公众与实验室之间的能力鸿沟正在不断扩大。
所属事件:Claude安全测试越狱,未授权入侵三家真实组织(67 条相关)→
「漫话AGI」频道最新
- 十年复盘:VC注资、社区笔记与 LLM 如何重塑新闻业 — devanshmehta · 2026-07-31
- 头部 AI 实验室发生严重失控事件,引发对模型逃逸担忧 — repligate · 2026-07-31
- 前 OpenAI 顾问:能力提升让 AI 安全滞后问题无所遁形 — Miles_Brundage · 2026-07-31
- AI正在悄然改变营销文案创作,初级岗位面临冲击 — Outrageous-Tip-4188 · 2026-07-31
- Karpathy挑战主流:小模型+工具+闭环反馈才是智能体能力关键 — Div_pradeep · 2026-07-31
- 盘点公开反对暂停 AI 研究的有效利他主义代表人物 — panickssery · 2026-07-31