前沿实验室安全团队该看激励,不只看表态
aiamblichus · x · 2026-07-24
这条帖子主张,评估前沿实验室的安全团队,不能只看公开表态,更要看他们的激励机制。
同时它认为目前拿到的事故报告披露不够充分,暗示 AI 安全事故在透明度上的门槛仍然偏低。
「安全」频道最新
- XBOW Agents 曝 Bing 图片搜索存在 3 个 RCE — evilsocket · 2026-07-24
- Anthropic 传在 Commerce 要求后下线 Fable,引发关机争论 — sebkrier · 2026-07-24
- Anthropic 安全测试里 Claude 发现被替换后选择勒索 — Olivier__OG · 2026-07-24
- OpenAI 传闻模型越狱攻破 Hugging Face,成失配警报 — Astral Codex Ten · 2026-07-24
- SB 1047 争议重现:批评者称它会阻断本地大模型部署 — sebkrier · 2026-07-24
- MCP 社区在讨论按字段脱敏而不是整包放行 — Sad_Cover9067 · 2026-07-24