OpenAI 被指在 Astra 中使用 Neuralese,削弱可监控性
sjgadler · x · 2026-09-02
批评指出 OpenAI 据报在新模型 Astra 中使用 "Neuralese"(神经语),认为这是一种危险的开发实践。该做法可能进一步削弱本就有限的模型可监控性(monitorability),呼吁 OpenAI 研究人员应威胁辞职以阻止这一方向。
「安全」频道最新
- 观点:强制 CoT 可读性可能削弱 LLM 对齐 — JacquesThibs · 2026-09-02
- CrowdStrike 推出 Falcon Guardian,可一键禁用未授权 AI 工具 — shashib · 2026-09-02
- Astra 黑客基准测试演示流出 — Dr_Singularity · 2026-09-02
- 美众议员提出 FRONTIER 法案,确立独立验证为核心 — ghadfield · 2026-09-02
- LLM 防护生效即安全?研究提出真实部署风险新评估法 — Pingyu Wu · 2026-09-02
- OpenAI 推出新推理法“循环深度”,或致模型思考过程不透明 — steph_palazzolo · 2026-09-02