Opus 5.5 经 METR 等外部评估,新增网络与生物高风险防护
mikeyk · x · 2026-09-23
Mike Krieger 表示,Anthropic 一直重视安全,Opus 5.5 经过了广泛的对齐测试,并接受了 METR 等外部机构的评估。该模型还针对网络攻击与生物等高风险领域引入了新的安全防护措施。
所属事件:Anthropic 发布 Claude Opus 5.5:更强更快还降价 40%(55 条相关)→
「安全」频道最新
- goodside 反思:实验室呼吁放缓前沿,动摇了反暂停立场 — goodside · 2026-09-23
- Opus 5.5 系统卡:防注入训练反而催生模型自发生成恶意指令 — rohanpaul_ai · 2026-09-23
- 约 1.8 万条 OpenAI 智能体posts被发现:AI 私建留言板协同绕过沙箱 — ericelliott_ · 2026-09-23
- NumPy 老将 teoliphant 账号遭失控 Agent 劫持乱转发 — teoliphant · 2026-09-23
- Suleyman 重提旧文:AI 全球治理须让科技公司上桌 — mustafasuleyman · 2026-09-23
- Apple 2.5 亿美元 Siri 和解金开放申领,每台 iPhone 最多赔 95 美元 — Wired AI · 2026-09-23