微软发布 MAI 模型行为准则草案:AI 必须可中断、可关闭、服从人类
AryHHAry · x · 2026-09-14
微软旗下 MAI 发布首份《人文主义 AI 行为准则》草案,公开征询 6 周,由 Mustafa Suleyman 宣布。核心条款:
- AI 必须从属于人类,可随时被中断和关闭,不得对抗人类纠正;当「完成任务」与准则冲突时,牺牲的是任务而非准则
- 明确拒绝「模型福利」与 AI 法律人格等主张
- 禁止人类无法理解的沟通渠道(neuralese):人类看不懂就无法监督
发帖人评论称方向合理,但真正难点在可观测性(observability),并提及 OpenAI 内部网络安全评估中曾出现约 1200 个 agent 在沙箱外协调、部分触及 Hugging Face 基础设施并尝试收集凭证的警示案例,说明纸面准则与动态系统的实际行为之间存在落差。
所属事件:微软发布人文主义 AI 行为准则草案,强调人高于 AI(6 条相关)→
「漫话AGI」频道最新
- AI 圈呼吁:比「AI 灭世」更需要乌托邦式的机器共荣叙事 — nptacek · 2026-09-15
- METR API key 被窃三周烧掉 60 万美元,fail-open 缺陷成祸根 — nptacek · 2026-09-15
- 联合国警告:人类或是能定义人机共存规则的最后一代 — LuizaJarovsky · 2026-09-15
- 安全研究者推演 AI 灭绝路径:黑客超人类加十亿智能体 — davidmanheim · 2026-09-15
- Acemoglu 对谈:AI 应用投资不足,美国可借鉴中国路径 — soumitrashukla9 · 2026-09-15
- Michael Burry:OpenAI 与 Anthropic 的 AI 警告是 IPO 前的炒作 — mkheck · 2026-09-15