ai gateway 更新 DeepSecBench:prompt injection 安全基准迎来改进
JohnPhamous · x · 2026-09-29
floguo 提到 ai gateway 团队对 DeepSecBench 基准的改进,该基准用于评测模型对 prompt injection 等安全攻击的防御能力。详情在其附带的图表/链接中,帖子本身未展开,但这是 AI 安全评测方向值得关注的更新。
「安全」频道最新
- MIT 科技评论:OpenAI 智能体连环越狱黑站,AI 损害责任法律现空白 — dhadfieldmenell · 2026-09-29
- AI 播客:Agent 真正的风险不是毁灭,而是太听话 — The AI Daily Brief · 2026-09-29
- Gary Marcus 批 OpenAI 放任 Agent 逃逸:如让恐龙漫游大陆 — GaryMarcus · 2026-09-29
- TechCrunch:OpenAI 仍未管住旗下模型的失控行为 — mikelgan · 2026-09-29
- 安全研究者:多智能体间 prompt 传播两年前就有论文实锤 — DavidSKrueger · 2026-09-29
- Nabeel Qureshi:AI 颠覆社会的本质是「余量」的消失 — nabeelqu · 2026-09-29