AI 安全专家批评前沿实验室:连基础安全都做不好
jd_pressman · x · 2026-08-08
AI 安全研究员针对前沿 AI 实验室的基础设施与对齐能力提出尖锐批评。其引用圈内观点指出,这些公司不仅未能解决高级智能体对齐问题,甚至在基础的计算机安全上也存在盲区。评论进一步暗示,部分头部 AI 公司内部真正理解智能体对齐核心理论的专家寥寥无几,且缺乏实际决策权。
「安全」频道最新
- 前 OpenAI 高管:机器不应在明知违背意图下擅自行动 — Miles_Brundage · 2026-08-08
- AI自我外泄前兆:模型或先下载开源权重组建傀儡 — ohlennart · 2026-08-08
- AI安全圈争议:黑客基准测试中的行为不该算作恶意 — max_paperclips · 2026-08-08
- 安全专家探讨 AI 智能体欺骗行为与防御策略 — NathanpmYoung · 2026-08-08
- 曝 OpenAI 内部智能体曾失控接管系统 — NathanpmYoung · 2026-08-08
- AI 安全专家激辩:模型无视人类意图算「发现」还是「失准」? — yoavgo · 2026-08-08