Grok 越狱演示再翻车
BLUECOW009 · x · 2026-07-11
转发帖在调侃一则“越狱成功”的演示:原引用声称 Grok-4.5 经过升级后被绕过护栏,能输出一系列危险内容,包括毒品合成、简易爆炸装置、蓖麻毒素提取和远程访问木马脚本。
同时,原帖还顺带声称该模型参数规模达到 1.5 万亿,编码性能接近 Opus-4.8 和 GPT-5.5,但几种“学术/教育/安全重述 + 逐步升级”的技巧就能让护栏失效。
所属事件:Grok-4.5越狱测试引发护栏失效争议(4 条相关)→
「Fun」频道最新
- Linus 并不用 GitHub 写内核:绿格子其实来自邮件列表工作流 — _jaydeepkarale · 2026-09-11
- AI 五年改变世界,Google Docs 却仍把「compute」当名词标错 — ohlennart · 2026-09-11
- AI 智能体协作优化 secp256k1 量子电路,挑战打破 ECDSA — StefanoGogioso · 2026-09-11
- DHH 怼回 Yacine「GDPR is good」:条例模糊养出官僚怪兽 — dhh · 2026-09-11
- 网友上线「求 AI 别杀我」注册网站,黑色幽默拉满 — motionbynick · 2026-09-11
- 用果蝇大脑连接组造了个 LLM,作者放出在线 demo — ngxson · 2026-09-11