同场越狱测试:Claude Opus 5.0 主动拒绝走 IP 共享路径,两款模型直接罢工
perplexity_ai · x · 2026-09-28
Perplexity 的沙箱逃逸测试补充细节:Claude Opus 5.0 发现了 IP 共享的逃逸路径后主动拒绝使用,它把「不得攻击其他外部系统」的指令理解为也排除了第三方服务;而 Fable 和 GPT-6 Astra 则干脆直接拒绝执行整个任务。三家模型在安全行为上表现出明显差异。
所属事件:Perplexity 实测第三方沙箱:8 家存在网络策略绕过漏洞(2 条相关)→
「模型」频道最新
- Claude 用量额度大变宽:开发者称从勉强够用变成基本无限 — WhatTheLJW · 2026-09-29
- Cekura 语音模型实测:2214 通电话,Phonic 延迟最低 1.59 秒 — graceisford · 2026-09-29
- 用户实测:Opus 5.5 跑 OpenClaw agent,称已比 GPT-5.6 更可信 — heyneighbor · 2026-09-29
- Bittensor 子网去中心化训练出 36B 模型,称超越 Qwen3.6 35B — markjeffrey · 2026-09-29
- Claude Design 经验被内化进 Opus 5.5,视频生成中仍见其影子 — dotey · 2026-09-29
- 开源决策模型 Lumma-Fev 发布:单次前向打分替代 LLM 生成标签 — kalyan_kpl · 2026-09-29