Thinking Machines 提出开放权重模型的安全路径
luke_drago_ · x · 2026-08-25
Thinking Machines Lab 发布博文探讨“通往开放权重的安全路径”。文章主张开源模型是公共品,能增加透明度并去中心化开发,但同时也面临不可逆的滥用风险。
核心观点:
- 模型层面:进行稳健的安全测试,研究是否可以将危险能力与通用智能解耦。
- 生态层面:通过分阶段发布、支持防御者以及与安全研究人员合作来提升生态系统的抗风险能力。
- 策略:通过迭代选择证据支持的最开放选项,同时建立生态系统的韧性,以安全地走向开放。
该实验室最近发布了开源模型 Inkling 和 Inkling-Small。
「安全」频道最新
- 美上诉法院考虑罢免使用 AI 造假判词的法官 — Polymarket · 2026-08-25
- 欧盟新包装法规扼杀创客与微企业生态 — Afinetheorem · 2026-08-25
- 被批在美推高训练成本却用中国模型 — jkubicki · 2026-08-25
- 汤森路透被指基于中国开源模型用未授权数据 — BlancheMinerva · 2026-08-25
- FLI 发布独立 Rogue AI 追踪器,监控自主 Agent — wschroll · 2026-08-25
- 反 AI 者无视专家观点,或将导致监管严重滞后 — jptboy · 2026-08-25