安全评测新基准 sec-bench 发布
HanchungLee · x · 2026-08-06
开发者 HanchungLee 发布了名为 "sec-bench" 的安全评测基准项目,并提供了相关链接。
「研究」频道最新
- 深扒 OpenAI 多智能体训练:跨实例信息传递的奖励机制猜想 — xuanalogue · 2026-08-06
- 长上下文瓶颈破局:多智能体编排优于扩展上下文窗口 — bingxu_ · 2026-08-06
- 菲尔兹奖得主反思《莱顿宣言》:AI如何重塑数学证明 — zetalyrae · 2026-08-06
- 研究称 44% 学生使用 AI 属于被动交互,获最佳论文奖 — guzdial · 2026-08-06
- Antares 模型发布:3B 参数比肩 GPT-5.5,单卡 H100 极速推理 — aminkarbasi · 2026-08-06
- 机器人靠“想象”学习:视频生成助力具身智能,成功率超 80% — imjustnewatai · 2026-08-06