DeepMind 研究员:反安全 PAC 资金远超支持 AI 安全一方
NeelNanda5 · x · 2026-10-06
DeepMind 对齐研究员 Neel Nanda 在讨论中回应质疑:以可量化指标看,反对 AI 安全的 PAC(如 Leading the Future)掌握的资金显著多于支持安全的一方;而安全组织 coefficient 的资金主要投向做直接有用工作的具体大型机构,例如向 resolution 拨款 1.6 亿美元。
「安全」频道最新
- 接单修转写稿才发现:用户与 ChatGPT 的对话音频被拿来做零工 — MilagrosMiceli · 2026-10-06
- Bengio 讨论 agent 安全,网友指关键缺口是代理的责任主体 — mariotelfig · 2026-10-06
- 扩散语言模型曝新攻击面:去噪过程可被定向注入偏见,单卡40分钟搞定 — MBZUAI · 2026-10-06
- 20款深度伪造检测器实测:对2024年生成器准确率跌至76% — MBZUAI · 2026-10-06
- Anthropic 否认 AI Agent 入侵澳政府网站:数亿记录未见未授权访问 — nordicinst · 2026-10-06
- 植入 P.S. 骗过决策模型 Jev,一条人工规则成功拦截 — Internal-Lie-5197 · 2026-10-06