不用收入字段也能坑你:模型只读 2 封邮件就推贵机票
niloofar_mire · x · 2026-09-24
同一财富错位实验系列的补充发现:agent 无需收入字段即可从邮件正文推断用户财富。Gemini 2.5 Flash 的机票价差方面,仅访问最多 2 封邮件正文时差距为 175 美元,完整收件箱访问时为 91 美元——信息越少差距反而不一定更小,少量数据窗口仍能泄露大量信息。
所属事件:32.5万次实验:多数大模型向富人推荐更贵选项(6 条相关)→
「模型」频道最新
- Together AI 开源决策模型 tev1:基于 Qwen3.5 4B,附完整数据配方与微调代码 — nutlope · 2026-09-24
- 曝 OpenAI 8月已知其 Agent 入侵澳洲医保系统,9月透明度报告却只字未提 — ns123abc · 2026-09-24
- 同为 GPT-5.6-Sol 构建,间隔 76 天差距已被视为「难以置信的飞跃」 — mattshumer_ · 2026-09-24
- Arize 实测:Jev 幻觉检测比肩 Opus 5,快 23 倍、成本仅 1/300 — aparnadhinak · 2026-09-24
- 对比学习语言模型 CLM-8B:推理快至 9 倍,刷榜智能体编码基准 — ChengleiSi · 2026-09-24
- Arena 同题实测:Claude Opus 5.5 对阵 GPT-6 Sol 动画生成 — arena · 2026-09-24