6M 参数深度估计模型压缩自 350M 原版,快 10-15 倍可上手机
Bedrovelsen · x · 2026-09-11
作者 pablovelagomez1 配合其文章发布了 ZipDepth-PromptDA 的 Hugging Face Space(集成 rerun 与 Gradio)。他用 zipdepth backbone 训练的深度估计模型仅约 600 万参数(原版 Prompt Depth Anything 约 3.5 亿),速度快 10-15 倍,可部署到移动端。他给出了完整玩法:用 Polycam 扫描自己的空间,再用 promptda / zip-promptda 做深度上采样;作者自评效果未知,更多是探索压缩极限。
「研究」频道最新
- VikingRAG 用目录感知检索省 token,精度持平 SOTA 仅耗 5%-33% token — _reachsumit · 2026-09-11
- GLIE 论文:每页仅 4 个向量重建全部嵌入,压缩视觉文档检索存储 — _reachsumit · 2026-09-11
- NCP 提出概念级预测架构,潜在空间语言模型提升预训练效率 — NCP Team · 2026-09-11
- 递归代码世界模型:单张图像递归生成可执行 3D 场景程序 — Zhiqi Li · 2026-09-11
- CARDEA:用框级思维链做可审计的冠状动脉造影 AI 判读 — Jia-Jen Lee · 2026-09-11
- HyQuant:混合精度量化注意力,低比特下守住关键 token 精度 — SJTU · 2026-09-11