模态动力学字体:用有限元振动模式驱动冻结视频扩散做字形动画

Maham Tanveer · hf · 2026-10-05

notredame 团队提出 modal kinetic typography:让矢量字形动起来表达语义概念,同时保持可读性。

核心思路:用字形自身的「自然振动模式」构建运动——从矢量轮廓组装有限元特征值问题,得到整字与各部件的最软模态(可弯曲),零能量解(刚体平移/旋转)以闭式解应用于各部件。动画时,冻结的视频扩散模型只监督模态的振幅与相位。

相比前方法的优势:

评测:在概念对齐相当或更好的情况下,运动更流畅、轮廓撕裂更少,优于 Dynamic Typography 与 AniClipart,人类评估者偏好度高于 Astra (GPT-6) 的结果。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →