应对朝鲜黑客攻击:Claude 拒绝协助,GPT 展现优势
DeryaTR_ · x · 2026-08-08
一位安全研究员在应对疑似朝鲜黑客的网络攻击时,发现 Anthropic 的 Claude(包括 Opus)拒绝提供调查协助。相比之下,OpenAI 的模型则顺利配合了安全响应工作。
这反映了两大前沿模型在网络安全等高风险场景下,安全护栏策略与实际可用性之间的显著差异。
「模型」频道最新
- 西方面临开源掉队危机,中国厂商持续分享SoTA模型 — teortaxesTex · 2026-08-08
- ChatGPT 语音模式突然频爆粗口,用户直呼意外 — Standard-Contest-949 · 2026-08-08
- 研究称 Claude 遇到 AI 圈名人会更严苛且多推理 — RexDouglass · 2026-08-08
- Anthropic更新Claude生物安全护栏,仍拒答基础常识 — iamaliveix · 2026-08-08
- 被指缝合旧论文,OpenAI 模型数学证明能力遭质疑 — RexDouglass · 2026-08-08
- Claude Code 误判网络安全内容,强制清空用户工作进度 — ivan_bezdomny · 2026-08-08