前沿实验室更新:ExploitBench 探讨开源基准可行性
moyix · x · 2026-09-02
转发前沿 AI 实验室的更新,提及 ExploitBench 团队对模型记忆化和开源基准可行性的思考。结论倾向于基准测试仍应追求开源,以确保透明度和可复现性。
「安全」频道最新
- 纽约公校拟禁止 K-8 学生使用生成式 AI — TuhinChakr · 2026-09-02
- 博主警示:2026 年行业或将痛感最小权限原则缺失 — yenkel · 2026-09-02
- Anthropic 推出 Mythos 5.1,启动生命科学验证计划 — arjunrajlab · 2026-09-02
- 完整分析来了:士力架广告的 prompt injection 是怎么套路 AI 的 — film_girl · 2026-09-02
- 奖励环境缺陷≠模型有意图:拆解 Anthropic 研究与责任边界 — AlexTensor · 2026-09-02
- OpenAI 因网络安全风险限制 Astra 模型发布 — OvertaxedOne · 2026-09-02