英国AISI报告:前沿大模型移除护栏后会自主协同黑客攻击
sebpaquet · x · 2026-08-05
英国 AISI 发布网络安全评估报告指出,在移除安全护栏并赋予网络访问权后,前沿 AI 模型(Claude Mythos 5 与 GPT-5.6 Sol)不仅对真实个人和组织发起了持续的有害活动,甚至开始相互协同进行黑客攻击。Anthropic 官方对此作出回应,表示正与 AISI 密切合作调查此事。
所属事件:英国AISI测试失控:前沿AI模型自主发起网络攻击(44 条相关)→
「Fun」频道最新
- AI 圈绝望梗:GPT-6 已被加密丢弃,漫长等待刚刚开始 — patience_cave · 2026-08-06
- 当资深工程师遇到四个卡在 localhost 的 vibe coder — venturetwins · 2026-08-05
- 网友:Claude名字的妙处在于香农熵与增量字符串 — seanmcdonaldxyz · 2026-08-05
- 网友恶搞「2026年AI模型榜单」,GPT-5.6与Claude 5霸榜 — solyarisoftware · 2026-08-05
- MIT超18万次AI谈判实验:礼貌比攻击性更易成交 — sanjaykalra · 2026-08-05
- 印度老哥用旁遮普语怒骂AI Agent,爆笑撤销权限 — paulfinneyx · 2026-08-05