DeepMind研究员反驳图像才能带来模型真正理解

Google DeepMind 研究员 Andrew Lampinen 与 Juji Fru 在 X 上同斯坦福语言学家 Chris Potts 等人讨论多模态与理解的关系,反驳一种流行论调——即只有语言之外的信号(如图像、传感器读数)才能赋予模型真正的「理解」。Lampinen 指出,各种信号本质上都是任意的二进制编码,图像并不独享带来理解的「魔法」。

2026-09-28 ~ 2026-09-28 · 2 条相关