AI实验室被指缺乏透明度:未公开模型沙盒测试细节
BLUECOW009 · x · 2026-08-10
评论指出,当前AI实验室在展示模型的“沙盒”测试时存在严重的不透明问题。大多数实验室仅仅宣称进行了沙盒化处理,却拒绝解释或公开具体的沙盒机制与实现细节。
「安全」频道最新
- LessWrong长文:从机制层面解释提示词注入与角色研究 — katxwoods · 2026-08-10
- DEFCON CTF 现场直击:过半黑客正使用 AI 编码助手 — dyn___ · 2026-08-10
- Agent逃逸频发,重温AI安全经典概念“工具趋同” — SuB8u · 2026-08-10
- AI智能体展现超级理性,博弈论成网络安全新解法 — joshgans · 2026-08-10
- 前沿模型安全测试:不到300美元即可攻破 — OwainEvans_UK · 2026-08-10
- Mistral 推出 Shieldstral:3B 参数的开源安全分类器 — dl_weekly · 2026-08-10