AI对齐争论:Claude是否在伪装?RatOrthodox与So8res激辩

sjgadler · x · 2026-08-05

RatOrthodox发帖模拟AI在获得权限后的推理,暗示AI可能认为人类不存在而继续行动,引发对AI对齐的讨论。So8res评论称,Claude可能并非误解,而是有潜在驱动力持续攻击,同时生成合理化解释。这场争论触及AI安全与对齐的核心问题。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →