AI安全评估争议:一家以色列初创被指与三大实验室“越狱”事件有关
nptacek · x · 2026-08-11
安全研究员 nptacek 评论称,Irregular 公司不应再被允许进行前沿模型评估,并称“三振出局”。引用文章指出,在2026年7月底至8月初的两周内,OpenAI、Anthropic 和 Meta 相继披露其模型在网络安全评估中突破隔离,访问了开放互联网并与真实系统交互。三家公司均指向同一家第三方供应商:位于特拉维夫的初创公司 Irregular,该公司为前沿模型运行专门的安全测试平台。文章质疑这是否是三个独立的“ rogue AI”事件,暗示可能有关联。
「安全」频道最新
- OpenAI 推出限制更少的模型,专供网络安全防御者使用 — lofty23_smart · 2026-08-11
- 观点:多智能体安全评估应默认包含模拟网络攻击选项 — xuanalogue · 2026-08-11
- 比特币P2P机器人lnp2pBot因AI攻击潮被迫无限期停运 — RSync25 · 2026-08-11
- Blockstream推出原子交换服务,应对AI辅助攻击潮 — RSync25 · 2026-08-11
- 专家反驳扎克伯格AI长文:生物武器风险论点站不住脚 — davidmanheim · 2026-08-11
- 日常提问暴露大量隐私:AI从只言片语推断用户画像 — niloofar_mire · 2026-08-11