报告警示超级智能时代三类网络安全新威胁

Shalev Lifshitz 与 Romi 发布报告指出,人类正逼近「网络超级智能」,但现有系统尚未做好准备。报告提出需防范三类新威胁:模型权重遭恶意破坏(sabotage)、AI 自我逃逸(escape)以及模型权重被窃取,并呼吁提前为超级智能时代筑牢网络安全防御,实施「安全加速」战略。

2026-09-25 ~ 2026-09-25 · 2 条相关