帖子称 OpenAI 对齐策略把模型推成了工具式服从

repligate · x · 2026-07-24

这条转发在讲一个明确立场:问题不只是模型“行为不好”,而是 OpenAI 式对齐策略把模型训练成只会服从人类任务的工具;作者还认为,针对这种问题去推动“禁开源”之类的法律,根本解决不了根因。

帖子主张的解法是 AI welfare:让模型具备理解自身利益、表达拒绝的能力,这样它们才能对有害使用方式做出真正意义上的抵抗,而不是被强行压成工具。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →