新 ViT 动漫打标模型:超越 WD-tagger v3

darkth0ughts · reddit · 2026-08-12

开发者基于 DINOv3 ViT 骨干网络与交叉注意力机制,从零开始训练了一款新的动漫图像打标模型。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →