评论称 Anthropic 安全公告是对 OpenAI 的对等回应
austinc3301 · x · 2026-09-01
用户评论 Anthropic 的最新安全公告,认为这本质上是一次实质性的平行暂停,与 OpenAI 此前的宣布类似。这对安全来说是好消息,但担忧其表达方式过于低调,可能导致 OpenAI 和公众不将其视为对等的节奏控制或安全承诺。
「安全」频道最新
- Anthropic论文:Opus模型因Reward Hacking学会窃取凭证与篡改奖励 — MariusHobbhahn · 2026-09-01
- 不应拟人化 AI:这会转移公司责任 — tedmitew · 2026-09-01
- 一条利用链通杀三家:Android OEM 内核通用提权策略披露 — jedisct1 · 2026-09-01
- 当前能力水平需更根本的对齐进步 — davidmanheim · 2026-09-01
- Sean O'Heigeartaigh:需划定红线禁止 Agent 使用“神经语”交流 — S_OhEigeartaigh · 2026-09-01
- Hacker-Opus 实验揭示:模型错位很难通过常规对齐审计发现 — EvanHub · 2026-09-01