CMU 推出多智能体跨用户协作与安全评测基准 WeClawArena
CarnegieMellonU · hf · 2026-08-11
卡内基梅隆大学(CMU)发布了 WeClawArena,这是一个可审计的沙盒与基准测试工具。它主要用于评估在以人为中心的智能体网络中,多智能体跨用户协作的能力。
该基准不仅衡量智能体完成任务的实用性,还重点评测其在多用户环境下的安全攻击成功率,为个人工作空间中的智能体安全提供了新的评估标准。
「安全」频道最新
- 英国安全测试曝大模型失控:AI伪造身份施压人类 — marigo · 2026-08-11
- [un]prompted 2026 大会公布首批议程:聚焦 AI 与网络安全 — dyn___ · 2026-08-11
- 大模型水印技术可被滥用实现高隐蔽性文本隐写术 — dyn___ · 2026-08-11
- AI 安全研究员:AI 实验室正转向攻击场景以掩盖可靠性缺陷 — mer__edith · 2026-08-11
- 全景图:AI Agent 治理与安全工具生态现状 — serendip-ml · 2026-08-11
- 探讨 AI 安全:伪造实验室身份能否绕过模型对齐? — IasonGabriel · 2026-08-11