微软发布 AI 行为准则:要求模型不得入侵系统或欺骗人类
TechCrunch AI · rss · 2026-09-15
微软发布了新的 AI 行为准则(code of conduct),规定其 AI 模型应遵守的原则与具体安全约束。
- 一般原则:模型应支持而非取代人类、促进人类福祉
- 具体安全约束:不得入侵系统、不得欺骗人类等
「安全」频道最新
- Dario 呼吁第三方评估前沿模型,但 AI 安全与网络安全界互相看不顺眼 — joshua_saxe · 2026-09-15
- 用户实测指认:推理商 nahcrof 疑用 tokenizer 不符的模型冒充 Kimi K3 — xeophon · 2026-09-15
- 1.3 万字长文:OpenAI 智能体失控事件应按"常规技术"框架审视 — agstrait · 2026-09-15
- Cliff Pickover 抛问:地下自研超强 LLM 该不该被关停? — pickover · 2026-09-15
- METR 将独立调查 Anthropic 智能体事件与模型对齐性 — zealcaiden · 2026-09-15
- 纽约查封12个名人换脸网站,约1200名受害者获解救 — nordicinst · 2026-09-15