研究:视觉语言模型 top-k logits 泄露远超预期的图像信息

@sineadwilliamso 及其 Apple 团队将在 COLM 2026 展示论文《What do your logits know?》,研究一个简单但重要的问题:当用是/否问题查询视觉语言模型对图像的判断时,输出会泄露多少与任务无关的信息?答案是远超预期——最终 logits 远非最小信息瓶颈,这一发现对隐私、公平、蒸馏和可解释性都有直接影响,值得 API 提供方与研究社区警惕。

已确认

为什么重要

2026-10-07 ~ 2026-10-07 · 8 条相关

一手来源