50 美分攻破 typed 决策模型:Check Point 实证 prompt injection 通杀
evilsocket · x · 2026-09-24
Check Point 研究团队测试了 Jev——一类返回结构化决策而非文本的新型 AI 模型,结果所有测试配置均被 prompt injection 攻破。
- 攻击结果:所有配置均被攻破,风险评级被下调为低、并建议投资一份满是警示信号的材料
- 成本:平均第 4 轮对话即成功,每次突破约 50 美分
- 结构化输入无效:typed、结构化输入并未显著提升抗操纵能力,要求模型不信任文档也没用
- 推理是最强防御:reasoning 是实测中最有效的缓解手段,但 Jev 没有可开启的推理设置
- 核心警示:返回「决策」的模型比返回文本的模型更危险——没人会去审查一个决策
「模型」频道最新
- OpenAI 给 Plus 用户加用量限制,超额需购 credits 或干等 — Exarchias · 2026-09-24
- 长文探讨:前沿模型进步太快,AI 基准测试已跟不上节奏 — knowerofmarkets · 2026-09-24
- 小米 MiMo-V2.6-Pro 登顶开源模型:AA指数46分逼近GPT-5.6,成本仅1/15 — kimmonismus · 2026-09-24
- ChatGPT 网页版 Advanced Voice 与 Standard Voice 悄然消失,无任何公告 — shaunralston · 2026-09-24
- DeepSeek Harness 官方客户端上架:Windows/Mac 免命令行使用 — op7418 · 2026-09-24
- DeepMind 负责人确认 Gemini 4 将于 2026 年不太晚的时候发布 — Novel-Nature-7741 · 2026-09-24