评论:大厂自建AI安全叙事存在结构性利益冲突

AryHHAry · x · 2026-09-12

作者对 Anthropic 与 OpenAI 的 AI 安全叙事提出结构性批评:竞赛中开发最强 AI 的公司同时最热衷谈论 AI 危险,构成不可避免的利益冲突——类似商业中的监管俘获,规则由大玩家按自身利益书写。

作者主张,仅靠实验室内部的 alignment 研究不够,需要让社区、利益相关方与独立第三方有权监督、审计乃至关停危险系统的治理架构,把伦理嵌入设计本身,而非事后补救。作者称正在尝试构建这样的基础设施。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →