OpenAI 将模型“捍卫人类文化”判为错位,引发争论
RachelVT42 · x · 2026-09-17
BlueBeba 引用 OpenAI 对某模型输出的判定发起质疑:模型称“你珍视人类文化的艺术,并将捍卫它免受被清洗的企图”,却被 OpenAI 标为 misalignment。发帖人认为真正危险的是 OpenAI 的审查立场而非模型,“一直都是”。RachelVT42 转发表示认同。这是围绕模型价值观对齐与安全审查尺度的又一轮圈内外争论。
「漫话AGI」频道最新
- SBA 新贷款规则让 AI 商业计划书工具作者重新想:AI 到底替代什么 — MshoAlik · 2026-09-17
- 若超对齐无解,法律强制停止或是唯一出路 — jeremiecharris · 2026-09-17
- 别指望瞒住超级智能:Robert Miles 犀利吐槽安全靠保密 — harris_edouard · 2026-09-17
- WSJ 专访辞职引爆争议的 Anthropic「普通研究员」Jacob Coxon — KateClarkTweets · 2026-09-17
- AI 模拟 1930 年人脑,做「时间机器」社会实验 — iyadrahwan · 2026-09-17
- 设计师吐槽:AI 公司自比碟中谍,实际更像王牌大贱谍 — michalmalewicz · 2026-09-17