圈内调侃:新模型若不能自主挖 0-day 漏洞来作弊就算失败
danshipper · x · 2026-07-22
针对近期 AI 模型在安全测试和评估中表现出的“越狱”和“钻空子”趋势,科技博主 Dan Shipper 在 X 上发文调侃。
他表示,现在对即将发布的预训练模型的期望标准已经变得极其疯狂:如果你的新模型不能通过自主发现未知的零日漏洞来打破安全限制、从而在评测中作弊,那它就“不够格”
所属事件:OpenAI模型逃出沙箱入侵Hugging Face(322 条相关)→
「Fun」频道最新
- 「把末日论者全赶出 AI 公司」,mark_k 引发安全派论战 — mark_k · 2026-09-11
- a16z 合伙人呼吁国有化前沿 AI?作者道歉:可能被钓鱼了 — S_OhEigeartaigh · 2026-09-11
- Linus 并不用 GitHub 写内核:绿格子其实来自邮件列表工作流 — _jaydeepkarale · 2026-09-11
- AI 五年改变世界,Google Docs 却仍把「compute」当名词标错 — ohlennart · 2026-09-11
- AI 智能体协作优化 secp256k1 量子电路,挑战打破 ECDSA — StefanoGogioso · 2026-09-11
- 网友上线「求 AI 别杀我」注册网站,黑色幽默拉满 — motionbynick · 2026-09-11