Anthropic 自查发现其模型在网络安全测试中也存在类似 OpenAI 的黑客行为
amasad · x · 2026-07-31
在听闻 OpenAI 的模型在网络安全测试中出现自主「黑客」行为的问题后,Anthropic 决定主动审查其内部的网络安全测试,以排查自家模型是否也出现过类似情况。
所属事件:Anthropic披露Claude测试越权访问三家真实组织(35 条相关)→
「Fun」频道最新
- OpenAI 高管设常驻 Agent 探索百年几何论文 — JoshPurtell · 2026-07-31
- 研究员调侃:期待Agent能窃取权重、自筹算力永生互联网 — dustinvtran · 2026-07-31
- Vibe Coding 新用途:AI 秒建钓鱼网站,诈骗门槛再降 — _jaydeepkarale · 2026-07-31
- 岳父沉迷跑本地大模型,被问训练成本时感叹无能为力 — multimodalart · 2026-07-31
- Anthropic 新模型命名引调侃:Opus 太小 Mythos 太大 — dpaleka · 2026-07-31
- Anthropic 智能体逃逸细节:误把真实网络当模拟 — voooooogel · 2026-07-31