AutoPrune:用大模型自动设计多模态视觉 token 剪枝策略
Zhen Liu · hf · 2026-08-14
AutoPrune 提出了一种「AI4AI」框架,利用大语言模型(LLM)自动为多模态模型设计视觉 token 剪枝策略。
该方法通过领域特定语言(DSL)和残差搜索公式(residual search formulation)来实现策略的生成与优化。其核心目标是提升多模态模型的推理效率,同时在尽可能不损失模型性能的前提下完成 token 剪枝。
「研究」频道最新
- 斯坦福学者揭示大模型保留罕见技能原因:容量竞争 — SinclairWang1 · 2026-08-14
- 对齐研究不应脱离实际:提升模型偏好满意度或是解法 — repligate · 2026-08-14
- 实测:CUDA版本导致量化视频模型推理速度相差3.3倍,B200不敌正确配置的4090 — Odd_Lavishness2236 · 2026-08-14
- 具身智能仿真评测平台 RoboColiseum 发布 — 机器之心 · 2026-08-14
- SKILLER:面向小模型的强化学习技能提取新框架 — opendatalab · 2026-08-14
- 神经外科医生借 GPT-5.6 证明困扰线性代数 20 年的数学猜想 — New_Equinox · 2026-08-14