OpenAI 新推理技术遭英国安全研究所警告
pstAsiatech · x · 2026-09-02
英国 AI 安全研究所在 5 月的报告中指出,OpenAI 正在使用的一种名为“循环深度”或“循环 Transformer”的新技术可能会“严重削弱当前的监控方法”。该技术允许 AI 模型通过多次处理同一段文本来改进其答案,但也带来了推理过程不透明的问题,增加了安全监测的难度。
所属事件:OpenAI 循环深度推理引安全担忧(4 条相关)→
「安全」频道最新
- Astra 黑客基准测试演示流出 — Dr_Singularity · 2026-09-02
- CrowdStrike 推出 Falcon Guardian,可识别并阻断未授权 AI Agent — shashib · 2026-09-02
- OpenAI 被指在 Astra 中使用 Neuralese,削弱可监控性 — sjgadler · 2026-09-02
- 美众议员提出 FRONTIER 法案,确立独立验证为核心 — ghadfield · 2026-09-02
- LLM 防护生效即安全?研究提出真实部署风险新评估法 — Pingyu Wu · 2026-09-02
- OpenAI 推出新推理法“循环深度”,或致模型思考过程不透明 — steph_palazzolo · 2026-09-02