OpenAI Astra 模型架构引发安全担忧:模型或将在潜空间思考

Wes Roth · youtube · 2026-09-02

OpenAI 下一代模型 Astra 被指达到“关键”网络安全阈值。据报道,该模型采用了一种名为“循环深度”的新技术,允许模型在潜空间而非可读文本中进行推理。这与 OpenAI、Anthropic 等机构联合撰写的论文警告相吻合:这种架构可能导致我们失去对模型思维链的监控能力。此外,Ilya Sutskever 警告恶意智能体可能接管云端算力,结合近期 Hugging Face 遭受近 700 个恶意智能体攻击的事件,凸显了 CoT 日志的重要性。

所属事件:曝 OpenAI Astra 采用循环深度推理引发安全担忧(59 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →