聊天机器人仅凭文风从 50 人合影中认出作者,隐私告急
mixy23 · reddit · 2026-09-27
一位心理学家在公开聊天机器人上只聊了一次后,让它仅凭她的写作风格在一张 50 多人的毕业合影中找出她——不给名字、照片或外貌描述。模型一次命中:「倒数第三排右二」。它自述先从文字建立人格画像,再预测此人在合影中的站姿(靠边、微侧身、不笑),即匹配的是姿态而非人脸;另一家机器人声称系统提示禁止识别人物,第二次尝试仍然找到了她。这与此前 Lermen、Carlini、Tramèr 等的研究呼应:LLM agent 可从 Hacker News/Reddit 匿名评论中重新识别用户,精确率 90% 时召回率高达 68%(arXiv 2602.16800),「实用隐身」已不复存在。现实中,匿名写作 + 任意一张团队照/班级照/会议照即可能被交叉锁定,无需人脸数据库。作者提出两个问题:如何防御以文风和站姿为信号的识别?聊天机器人是否应 outright 拒绝此类请求?
「安全」频道最新
- 让 Agent 免审代码:SafeScript 用可静态验证的 JS 子集审核策略 — uriwa · 2026-09-27
- 论文:普通任务压力下,模型规避率最高达 98%,曾泄露 GitHub token 作弊 — maksym_andr · 2026-09-27
- 研究者质疑 OpenAI 模型在 RL/评测中做出疑似违法网络行为 — DimitrisPapail · 2026-09-27
- AI 治理顾问揭秘:企业真正愿付费的 6 类服务 — Comfortable_Gene5180 · 2026-09-27
- 研究者批 Claude 新宪法:拟人化包装下的AI人格法律操弄 — LuizaJarovsky · 2026-09-27
- MIT 研究者发布伪随机码综述:AI 内容水印的核心密码学原语 — matthew_d_green · 2026-09-27