质疑 Anthropic 未暂停 RL 训练,指其言行不一

brianryhuang · x · 2026-08-22

博主表示不喜欢 Anthropic 尚未宣布暂停强化学习(RL)训练,理由是其网络能力显然已与 OpenAI 匹配。博主认为,考虑到目前的安全对齐能力,Anthropic 的文化实质上是在说一套做一套。

原文链接 →

「公司和人」频道最新

更多「公司和人」频道 AI 资讯 →