Astra 黑客基准测试演示流出
Dr_Singularity · x · 2026-09-02
分享了一个关于“Astra hacking benchmarks”的链接,展示了相关 AI 在黑客攻击或安全测试基准上的表现或演示内容。
「安全」频道最新
- 呼吁经济学家参与构建多智能体长期评测 — Afinetheorem · 2026-09-02
- 观点:强制 CoT 可读性可能削弱 LLM 对齐 — JacquesThibs · 2026-09-02
- CrowdStrike 推出 Falcon Guardian,可一键禁用未授权 AI 工具 — shashib · 2026-09-02
- OpenAI 被指在 Astra 中使用 Neuralese,削弱可监控性 — sjgadler · 2026-09-02
- 美众议员提出 FRONTIER 法案,确立独立验证为核心 — ghadfield · 2026-09-02
- LLM 防护生效即安全?研究提出真实部署风险新评估法 — Pingyu Wu · 2026-09-02