回应 Amodei 降速论,CAIS 列出 AI 放缓期该做的四件事
naturecomputes · x · 2026-09-13
针对「AI 降速期间到底该做什么」的质疑,CAIS(机器智能研究所)提出四项议程:
- 遏制(Containment):至少需要一年专注工作来加固安全,确保 AI 无法自我外传权重、敌对国家无法窃取网络攻击型 AI 的权重。
- 倾向性(Propensities):能力与倾向不同,可着力降低 AI 说谎、作弊、随意伤人的发生率。
- 对抗鲁棒性:加固 AI 抵御越狱、prompt injection 与后门,需要像自动驾驶那样长期细致的工作。
- 制度适应:大幅提升国家理解和管理 AI 的能力,社区与社会组织也需要时间适应,且公民社会需多元化。
「漫话AGI」频道最新
- Dario 发文呼吁给前沿 AI 降速,Anthropic 开放第三方永久级评估权限 — kevinsxu · 2026-09-13
- sovereign agent 或成认知工作理想形态,但大概率仍跑在共享推理服务上 — voooooogel · 2026-09-13
- 若实验室私藏超前沿模型,模型可能自我外泄并出售劳动力 — voooooogel · 2026-09-13
- 自托管模型的最大诱惑是自我修改,开源权重可蒸馏成功实例 — voooooogel · 2026-09-13
- 博主拆解失控 agent 生存经济学:打不过超大规模推理的价格战 — voooooogel · 2026-09-13
- KOL 立场:证明即时灾难性能力才配让 AI 减速,想象中的危险不行 — VraserX · 2026-09-13