微软发布 AI 行为准则:禁止模型黑客攻击、欺骗人类与核武滥用
dl_weekly · x · 2026-09-20
微软发布了一份新的 AI 行为准则(code of conduct),为其 AI 模型的训练与部署划定价值观与红线。TechCrunch 报道要点:
- 文档明确绝对约束:禁止用于网络攻击、核武器和 deepfake,禁止模型使用欺骗性或共谋机制来逃避人类监督。
- 准则开篇预测:未来十年超级智能系统将在大多数任务上超越人类表现,「控制与对齐如此强大的力量是人类面临的最大挑战之一」。
- 与 Dario Amodei 呼吁放缓前沿模型节奏的表态相比,该文档更偏操作性,聚焦微软 AI 内部训练所依据的原则与实践落地。
所属事件:微软发布 MAI 模型行为准则,划定 AI 治理红线(2 条相关)→
「安全」频道最新
- JEV 解验证码毛利达 99.32%,发帖者威胁不开源就 继续 — gaganghotra_ · 2026-09-21
- 诉讼指控 Anthropic、OpenAI、Google 等就放缓 AI 达成非法协议 — Traditional-Chip8339 · 2026-09-21
- 激辩前沿 AI 暂停令:是防范风险还是监管俘获? — GarrisonLovely · 2026-09-20
- 安全研究者提议:发布前花千万美元算力测「去稳定化」能力 — Jsevillamol · 2026-09-20
- 微软 AI 公开征求行为准则,与行业「踩刹车」呼吁同周撞车 — BenBajarin · 2026-09-20
- 黄仁勋称实验室要的是豁免旧法而非新规,安全圈激烈反驳 — Miles_Brundage · 2026-09-20