质疑 Anthropic 未暂停 RL 训练,指其言行不一
brianryhuang · x · 2026-08-22
博主表示不喜欢 Anthropic 尚未宣布暂停强化学习(RL)训练,理由是其网络能力显然已与 OpenAI 匹配。博主认为,考虑到目前的安全对齐能力,Anthropic 的文化实质上是在说一套做一套。
「公司和人」频道最新
- OpenAI 设计负责人:AI 加速执行后,设计师转向判断与验证 — 机器之心 · 2026-08-22
- 因家族乳腺癌悲剧,AI 科学家创立 Niramai 开发热成像筛查 — santoshpanda · 2026-08-22
- Agentic AI Summit 2026:五千人齐聚伯克利,共探智能体未来 — Scobleizer · 2026-08-22
- AI 编码带来的副作用:造物速度远超找用户速度 — Caramel_Secret · 2026-08-22
- 独立开发者吐槽用户对产品收费感到震惊 — Kyrannio · 2026-08-22
- 75 亿美元买“电表”?Stripe 收购 OpenRouter 的 IT 视角解读 — sanjaykalra · 2026-08-22