Balesni 警告全循环 LLM 架构将重创安全

j_asminewang · x · 2026-09-02

Balesni 认为,转向全循环 LLM 架构将是 AI 历史上对安全的最大打击。他呼吁所有 AI 实验室承诺限制模型的不透明串行深度,以防止最坏结果。OpenAI 研究员 Merettm 引用回应称,现有前沿模型(包括 Astra)的计算图深度在 GPT-4 的两倍以内,OpenAI 致力于利用思维链监控技术来研究对齐泛化。

所属事件:OpenAI 集中回应 neuralese 争议:前沿模型仍可监控(11 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →