Thinking Machines 提出开放权重安全发布路径:分阶段开放与生态建设
thinkymachines · x · 2026-08-01
Thinking Machines Lab 发布新文章《A Safe Path to Open Weights》,阐述其开放权重模型的安全发布策略。文章指出,无差别发布权重不安全,但将强大模型局限于少数实验室同样不可取。他们主张在两者之间寻找路径:对模型进行严格安全测试,研究危险能力与通用智能的解耦;对生态系统,通过分阶段发布、支持防御者、与安全研究者合作来提升其韧性。文章强调开放权重模型是公共产品,但发布不可逆,需谨慎。
所属事件:Thinking Machines阐述开放权重安全路径(3 条相关)→
「安全」频道最新
- OpenAI 封禁柬埔寨基于 ChatGPT 的跨国诈骗网络 — OpenAI News · 2026-08-04
- 密码学家呼吁:需建立全新 IDS 体系以应对 AI 自动化攻击 — matthew_d_green · 2026-08-01
- Meta 提出渐进式开放策略:开源权重与安全可兼得 — ZhongRuiqi · 2026-08-01
- OpenAI 封禁柬埔寨跨国诈骗网络:ChatGPT 被用于批量造谣与洗钱 — 机器之心 · 2026-08-01
- 开发者求助:OpenRouter API 密钥疑遭窃取,一夜被刷 70 美元 — Fit-Spring776 · 2026-08-01
- AI安全研究员探讨开源权重模型的发布与风险解耦 — clarejtbirch · 2026-08-01