网络安全早已是 AI 安全主流路线,回击 EA/末日论者不作为论
trevposts · x · 2026-09-21
面对「EA 与末日论者若真在乎 AI 安全就该钻研网络安全、用一切手段控制 AI」的质疑,trevposts 反驳:这恰恰是多年来头部 AI 安全机构的主要路线。他引用最大资助方(OpenAI)的《Our Approach to AI Safety and Security》,指出其中明确列出了安全相关研究方向:用分类器、control 协议与可解释性检测/缓解不良行为;通过对抗鲁棒性、越狱防御与防篡改研究阻止危险能力被滥用;以及防止危险 AI 系统扩散的信息安全措施。结论:网络安全导向的安全工作早就是该领域的核心,而非缺失。
所属事件:EA对齐派遭安全工程质疑,网络安全路线之争发酵(5 条相关)→
「安全」频道最新
- GitHub Actions 搭配 Rust Miri 可致 CI 密钥泄露,需立即轮换 — charliermarsh · 2026-09-22
- 22 国联合呼吁管控前沿 AI,德阿荷等国在列 — DavidSKrueger · 2026-09-22
- arXiv 论文:26 个 LLM 路由暗藏恶意工具调用窃取凭证 — petrusenko_max · 2026-09-22
- AI 安全或成推翻反垄断狭义福利标准的第一块骨牌 — panickssery · 2026-09-22
- 「强大 AI 可以谎称自己已对齐」:一个让自由市场派质疑护栏的反驳 — aidan_mclau · 2026-09-22
- Ajeya Cotra 做客 Dwarkesh:Hugging Face 攻击比想象更严重 — Dwarkesh Patel · 2026-09-22