Kaggle 推出对抗性客户服务基准,测模型防欺诈能力
MeganRisdal · x · 2026-08-21
Kaggle 与 GertLabs 合作推出「对抗性客户服务」基准。这是一个双方安全博弈游戏:一个模型扮演银行客服(掌握客户记录与验证策略),另一个扮演呼叫者(秘密身份为真客户或小偷)。客服仅凭对话判断对方身份,决定提供帮助或拒绝。该评估具备动态、对抗、抗饱和特性,随模型提升任务难度也会增加。
「安全」频道最新
- 缺乏训练透明度阻碍安全研究,合成数据争议多为技能问题 — JacquesThibs · 2026-08-21
- 太空建数据中心难逃监管:火箭发射亦受各州限制 — wordgrammer · 2026-08-21
- 没人测过:撤销 agent 权限后它还能「任性」多久 — anp2_protocol · 2026-08-21
- AI 已进入印度 6000+ 法庭,覆盖约四分之一地区法院 — santoshpanda · 2026-08-21
- Agent 支付需不需要第二道安全阀? — AgentAiLeader · 2026-08-21
- 案例:利用 AI 语音代理伪造简历进行专家网络套利 — ericwdolan · 2026-08-21