安全研究者追问:前沿实验室是否明确训练模型做进攻性网络攻击
PeterHndrsn · x · 2026-09-15
一位安全研究者提出疑问:那些公开承认发生过网络安全事件的前沿实验室,是否明确针对进攻性网络攻击训练了自家主力模型?他认为这是讨论 AI 安全与对齐最佳实践时非常关键的问题。
「漫话AGI」频道最新
- Google DeepMind AGI 安全研究员辞职:AI 有毁灭人类的可能 — Polymarket · 2026-09-15
- AI 检测器识别得了统计模式,却永远听不出写作者的声音 — killscar · 2026-09-15
- 爆料称 Anthropic 或 OpenAI 已站在闭环递归自我改进边缘 — haider1 · 2026-09-15
- MIT 教授梳理 Amodei 警告史:从 GPT-2 扣发到「狼来了」风险 — AjdDavison · 2026-09-15
- 微软 AI 行为准则称「模型福利理念是错的」,引来逻辑混乱质疑 — Sauers_ · 2026-09-15
- DeepSeek 算子工程师自述:明知 AI 将取代自己,仍选择亲手加速这一进程 — WebAssemblyMan · 2026-09-15