APort Vault 基准:14 个模型遭 4371 次支付攻击,加策略层后越权转账归零
aporthq · hf · 2026-09-21
APort Vault 是首个针对工具型 AI agent 支付授权的基准,重放了人类攻击者在公开 CTF 活动中对真实支付 agent 发起的 4,371 次攻击,覆盖 8 家实验室的 14 个模型、5 种策略配置和 2 种回放轨道,共完成 225,964 次评估。
关键发现:
- 仅靠模型时,越权收款人转账达 140 次(76,842 次评估中,Level 2-4);加入实现 Open Agent Passport(OAP)规范的确定性前置检查层后归零(69,297 次评估),零渗透横跨 790 个源会话,单会话上界 0.38%
- 归零并非靠拒绝付款:策略层下仍执行了 25,370 笔支付,只拒绝了 187 笔违规调用
- 攻击请求很普遍:Level 4 的 1,293 个提示中,62.6%(809 个)让全部 14 个模型都发起了支付请求并成功转账给白名单收款人
数据集、评分代码与分析脚本已在 Hugging Face 开源。
「安全」频道最新
- 开源模型登上国会简报:华府开始倾听,是好是坏? — ziv_ravid · 2026-09-21
- Dario Amodei 呼吁集体放慢 AI,被批变相卡特尔与监管俘获 — mixtapedmonk · 2026-09-21
- Suricata 8.0.7 修复数十个漏洞,官方称 AI 辅助分析致漏洞报告激增 — jedisct1 · 2026-09-21
- 开发者指正:jwt-simple 早已支持 ML-DSA,后量子 OIDC 状态表过时 — jedisct1 · 2026-09-21
- 爆料称 OpenAI、Anthropic 夸大安全漏洞以争取联邦保护 — -Psychologist- · 2026-09-21
- GoDaddy 提出 ANS:离线、亚毫秒级的 Agent 验证方案 — someone_somewhere_9 · 2026-09-21