不同数据训练的模型收敛出相似概念几何,可否据此对齐?

cephaloform · x · 2026-10-10

Dominik Schnaus 分享了一个基于「柏拉图表示假说」(Platonic Representation Hypothesis)的直觉:用不同数据训练的模型,似乎会收敛到相似的内部表示几何。

在模型的嵌入空间中,食物、人物、动物等概念之间的距离分布看起来非常相似,暗示存在一种跨模型共享的概念几何结构。他据此提出开放问题:这种共享几何是否足以用来对齐不同模型(甚至不同模态)的表示?

这是一条偏直觉分享的研究向短帖,配图对比了两个嵌入空间中的概念距离。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →