一场重构LLM理解的cross-entropy课

anselm · x · 2026-07-20

一位 Stanford 数学背景的讲者做了一个 **33 分钟的 cross-entropy 公开课**,被转发者评价为“接近可公开观看的 ML 博士资格考试”。 帖子的核心观点是:很多人把语言模型理解成“预测下一个词”,但从数学上看,它更像是在**压缩语言**。转发者认为,一旦看懂这套数学直觉,就很难再回到原来的理解方式,适合今天就收藏来看。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →