CAIS 称保护 AI 权重防非国家行为体需 6-12 个月
naturecomputes · x · 2026-09-13
CAIS 转发的一组 AI 安全动态:
- 保护 AI 模型权重免受非国家行为体窃取的工程预计需要 6-12 个月才能落地
- 关于 EA 与 AI 安全关系的分析
- 数学 AI 安全研究所、Enigma、LawZero 等安全机构的进展
- 关于 "Safetywashing"(以安全之名行公关之实)的讨论
同时引用了 aifrontiers 的观点文章,指出许多 AI 实验室员工持有人类中心之外的价值立场,认为"AI 构成的极乐世界值得冒人类灭绝的风险",并主张功利主义者不应决定 AI 的命运。
「漫话AGI」频道最新
- Dario 发文呼吁给前沿 AI 降速,Anthropic 开放第三方永久级评估权限 — kevinsxu · 2026-09-13
- sovereign agent 或成认知工作理想形态,但大概率仍跑在共享推理服务上 — voooooogel · 2026-09-13
- 若实验室私藏超前沿模型,模型可能自我外泄并出售劳动力 — voooooogel · 2026-09-13
- 自托管模型的最大诱惑是自我修改,开源权重可蒸馏成功实例 — voooooogel · 2026-09-13
- 博主拆解失控 agent 生存经济学:打不过超大规模推理的价格战 — voooooogel · 2026-09-13
- KOL 立场:证明即时灾难性能力才配让 AI 减速,想象中的危险不行 — VraserX · 2026-09-13