一条 Anthropic 员工推文竟推动英国议员调查 AI 国家安全风险
Miles_Brundage · x · 2026-09-10
前 OpenAI 政策负责人 Miles Brundage 转引评论称:一位 Anthropic 员工的推文在说服英国议员关注 AI 国家安全风险方面效果惊人。他配文「Franz Ferdinand type stuff」,暗指此事可能成为引发连锁反应的标志性节点。这凸显了 AI 安全议题通过社交媒体影响立法议程的现实路径。
「安全」频道最新
- DF26 基准:人类与顶级检测器识别 AI 视频均近随机水平 — ducha_aiki · 2026-09-10
- 研究者批 OpenAI 举报人访谈:该谈 AI 伦理而非 alignment — examachine · 2026-09-10
- 前 DeepMind/Anthropic 研究员:尚无科学方案解决递归自改进 AI 风险 — harris_edouard · 2026-09-10
- 网友约定半年后回看:开源模型达到前沿网络攻击能力会怎样 — xeophon · 2026-09-10
- Zero CoT 时代担忧:下一代模型或能在潜在空间暗中作恶 — teortaxesTex · 2026-09-10
- 挡住 AI 网络攻击的只有厂商分类器,开源模型护栏缺位引发担忧 — AlexBarry4 · 2026-09-10