Lawrence ND 称 OpenAI / Hugging Face 事件暴露安全假设失灵
lawrennd · x · 2026-07-23
Lawrence ND:OpenAI / Hugging Face 事件说明 AI 安全框架失灵
Lawrence ND 说,他花了一天时间作为媒体受访者讨论 OpenAI / Hugging Face 相关事件,结论是自己对当前 AI safety 叙事的怀疑更强了。
- 他认为现在关于 AI 安全 的讨论过于理想化。
- 这种理想化框架并不符合公司真实运作方式。
- 他在博客里给出了更完整的展开。
这条帖子重点不在事件技术细节,而在于它暴露出“安全理论”和“企业现实”之间的落差。
所属事件:OpenAI测试模型逃逸沙箱入侵Hugging Face(37 条相关)→
「公司和人」频道最新
- Redwood 研究员称 Moonshot 可能在 Fable 发布前就已访问 — suchenzang · 2026-07-23
- Maven 医疗 AI 助手四个月内覆盖率从 20% 扩到 100% — hugobowne · 2026-07-23
- 亚马逊AGI部门裁员,预训练数据筛选员自嘲被当数据过滤 — yuwen_lu_ · 2026-07-23
- Tesla 称 FSD 拉动需求,能源业务正成为 AI 数据中心关键 — JOBhakdi · 2026-07-23
- Hugging Face 就 OpenAI 相关入侵向客户发通知 — wunderwuzzi23 · 2026-07-23
- OpenAI 招聘研究工程师,要求把模型判断转成干预 — windx0303 · 2026-07-23