APort Vault 基准:14 个模型遭 4371 次支付攻击,加策略层后越权转账归零

aporthq · hf · 2026-09-21

APort Vault 是首个针对工具型 AI agent 支付授权的基准,重放了人类攻击者在公开 CTF 活动中对真实支付 agent 发起的 4,371 次攻击,覆盖 8 家实验室的 14 个模型、5 种策略配置和 2 种回放轨道,共完成 225,964 次评估。

关键发现:

数据集、评分代码与分析脚本已在 Hugging Face 开源。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →