Thom Wolf 携手 Baselabs/Baseten/Goodfire 推进开源模型安全研究
Thom_Wolf · x · 2026-09-17
- Hugging Face 联合创始人兼首席科学家 Thom Wolf 宣布与 Baselabs、Baseten、GoodfireAI 开始合作,共同推动开源模型的安全与可解释性研究。
- 他强调:开源模型性能正在追平前沿闭源模型,社区有机会为安全、安保和可解释性建立共同实践标准。他反驳了「开源=无监管」的说法,认为开源模型反而提供更多工具和可见性,吸引更广泛研究者参与安全工作,今天许多安全技术正源于此。
- 他以 Linux 为例:开源与安全部署不仅兼容而且深度绑定,安全系统需要广泛「发现并修复漏洞」的反馈循环。被引用的推文还提到 OpenAI agent swarm 攻击 Hugging Face 的事件,认为这类故障是开源模型追平时需要提前准备的风险案例,托管方 Baseten 在建立安全与监控标准上扮演关键角色。
所属事件:Hugging Face 联合 Baseten、Goodfire 推进开源模型安全研究(3 条相关)→
「公司和人」频道最新
- OpenAI 频繁暗示千禧年难题取得进展,或于 9 月 29 日 DevDay 公布 — haider1 · 2026-09-17
- 前 Waymo CFO Elisa de Martel 跳槽自动驾驶创企 Wayve — alexgkendall · 2026-09-17
- Sentry 拟为 AI 项目 Junior 招全职,要求有 agent 与开发工具经验 — zeeg · 2026-09-17
- Cursor 招聘产品教育工程师:要求亲手用产品到极限再写教程 — AIFlow_ML · 2026-09-17
- Datadog 还是 2021 SaaS 之巅的样板吗?付费专栏剖析其争议口碑 — thedealdirector · 2026-09-17
- FLORA 设计师 AI 课程开放申请,9 月 18 日截止 — round · 2026-09-17