不足 10 万参数的视觉系统 TAPe+ML 在 COCO 检测达 84.7 mAP50

Comexp · hf · 2026-09-22

研究团队发布 TAPe+ML v3,基于“主动感知理论”(TAPe)的结构化表示:在识别之前先编码感知元素之间的关系,而非直接处理像素张量,配合模块化识别架构统一完成分类、检测与实例分割。

核心主张:把部分建模负担从网络参数转移到结构化输入表示,可以在更少数据、内存与算力下支撑紧凑的多任务视觉系统。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →