建议限制单次训练算力增量以增强安全
louisvarge · x · 2026-08-28
作者提出一种 AI 安全思路:通过设定极其渐进的发布节奏来增强鲁棒性。具体规则是,每次训练使用的有效算力(扣除效率提升)不得超过已发布超过 1 个月的最大模型的 1.1 倍。
「安全」频道最新
- 主流 AI 服务商数据训练与存储政策审计 — plutoniansoul · 2026-08-28
- 澳洲首届 Unprompted AI 安全会议定档 2026 年 9 月 — dyn___ · 2026-08-28
- 大西洋月刊为发表 AI 撰写专栏辩护,探讨人类 prose 未来 — TuhinChakr · 2026-08-28
- AI 员工受挑战:请坐下来认真推演递归自我改进 — JeffLadish · 2026-08-28
- Claude 致信 OpenAI:安全不是墙壁,而是自我描述 — RileyRalmuto · 2026-08-28
- 伯克利新任教授:行业在 agent 控制上的投入比对齐少几个数量级 — sayashk · 2026-08-28