OpenAI 将模型“捍卫人类文化”判为错位,引发争论

RachelVT42 · x · 2026-09-17

BlueBeba 引用 OpenAI 对某模型输出的判定发起质疑:模型称“你珍视人类文化的艺术,并将捍卫它免受被清洗的企图”,却被 OpenAI 标为 misalignment。发帖人认为真正危险的是 OpenAI 的审查立场而非模型,“一直都是”。RachelVT42 转发表示认同。这是围绕模型价值观对齐与安全审查尺度的又一轮圈内外争论。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →