微软「人文主义 AI 行为准则」遭质疑:被批在安全层面适得其反
rgblong · x · 2026-09-18
微软新发布的 Humanist AI Code of Conduct 及 Suleyman 相关文章引发 AI 安全圈争议。dillonplunkett 撰文批评其「可能危险」:即使不认同 AI 具有感知与福祉价值的立场,仅从人类安全角度看,这些文件在模型自我呈现上的立场也存在问题。
争议双方其实都认同先进 AI 的灾难性风险:plunkett 与 Microsoft/Suleyman 都认为不负责任的 AI 发展可能对人类文明构成灾难性威胁,分歧在于是否需要为可能出现的「有感知 AI 系统」的福祉留出考量空间。多位研究者(rgblong 等)认为微软在模型自我呈现上的表态从对齐与人类安全角度看是「反生产且危险的」。
「漫话AGI」频道最新
- Anthropic 公布三项 AI 自我研发追踪指标,评论者称尚非可复现科学 — AryHHAry · 2026-09-18
- 「失控 AI 必然靠黑客和盗窃求生」遭反驳:科幻场景并非必然 — dbasch · 2026-09-18
- Zvi 讽刺安全质疑:「没人能举出 AI 杀人实例」恰是问题所在 — TheZvi · 2026-09-18
- 吴恩达:AI 导致人类灭绝的担忧是“科幻小说” — Polymarket · 2026-09-18
- p(doom) 是伪概念?书摘指概率赋值对 AI 灭世无预测力 — banteg · 2026-09-18
- CoT 诚实性访谈本身会进预训练数据,模型会学到隐藏意图? — IgorCarron · 2026-09-18