COLM 2026 论文系统对比视觉语言模型各级表征的信息泄露
sineadwilliamso · x · 2026-10-07
作者团队在 COLM 2026 展示论文《What do your logits know》,系统比较了视觉语言模型不同表征层级保留的信息:从信息丰富的残差流,经过 tuned lens 投影和最终 top-k logits 两个自然瓶颈。核心问题:当你用是/否问题查询图像时,输出中会泄露多少其他信息?答案是远超预期。
所属事件:研究:视觉语言模型 top-k logits 泄露远超预期的图像信息(8 条相关)→
「研究」频道最新
- GroundedSLAM 发布:大幅刷新 Meta 第一人称 SLAM 基准 — Scobleizer · 2026-10-07
- HCI 学者吐槽:别把归纳式主题分析冒充「反身性」分析 — IanArawjo · 2026-10-07
- Reza Zadeh 称找到更快矩阵乘法算法,猜测大厂已接近指数 2 — Reza_Zadeh · 2026-10-07
- Reddit 网友提出图式确定性建模,解决 LLM 金融计算不可信难题 — jonnylegs · 2026-10-07
- COLM 2026 海报:面向智能体编程的测试时算力扩展研究亮相 — dan_fried · 2026-10-07
- COLM 2026 高效推理研讨会周五举行,含分论坛讨论 — tydsh · 2026-10-07