AI 安全学者对谈:基准越复杂,可被攻击的面就越大
sarahcat21 · x · 2026-10-09
sarahcat21 分享 AJ Ratner 与 Dawn Song 的对谈片段,讨论基准测试的审计与加固挑战。核心观点:「越复杂、越多评判标准,可被利用的攻击面就越大」——两人探讨了通过红队测试等手段对 benchmark 进行审计和加固的思路。涉及 AI 评测体系的安全性问题。
「安全」频道最新
- 密码学家解析"公钥加密失守"意味着什么:并非加密消亡 — matthew_d_green · 2026-10-09
- 法国拟设立 AI 专属行政监管机构,与 DINUM 等多机构并行 — julsimon · 2026-10-09
- Grok 审查问题争论:锅在架构而非模型 — xtel9 · 2026-10-09
- GPT-6 Sol 信任访问版登顶 Cyber Index,单任务成本仅 Grok 的 1/6 — ArtificialAnlys · 2026-10-09
- 99.7% 公司有 AI 政策,87% 仍被越权触达敏感数据 — daniel_tenuo · 2026-10-09
- 密码学家回应加密破产传闻:前沿实验室提问方向泄露蛛丝马迹 — matthew_d_green · 2026-10-09