超级智能外泄路径引热议:侧信道还是操纵人类

围绕 Noam Brown 提出的 AI 风险情景,社区展开讨论。akbirthko 等人对 Brown 具体的热学侧信道攻击设想持怀疑态度,但认为纠结于某个固定场景是人类想象力的失败,核心问题在于优化压力是否足以让超人类 AI 想出新颖的侧信道攻击,甚至只需 1 比特的信息就能触发雪崩式后果。另有网友 basedjensen 提出,真正超级智能的模型更可能通过操纵人类操作员、说服其插上 U 盘来实现权重外泄,而非科幻式的秘密手段。

2026-09-18 ~ 2026-09-18 · 3 条相关