Inference AutoTune 发布:25行代码将大模型蒸馏为小模型
Inference AutoTune 正式发布并逐步向更多用户开放。该工具的核心功能是将任意前沿大模型蒸馏为参数量在 1 至 30B 之间的任务专用小模型(SLM)。其主打极高的易用性,开发者仅需 25 行代码即可完成模型蒸馏操作,大幅降低了定制和部署小模型的门槛。
2026-07-12 ~ 2026-07-13 · 2 条相关
- Inference AutoTune 发布 — Scobleizer · 2026-07-12
- AutoTune可将模型蒸馏成小模型 — AccBalanced · 2026-07-13