Inference AutoTune 发布:25行代码将大模型蒸馏为小模型

Inference AutoTune 正式发布并逐步向更多用户开放。该工具的核心功能是将任意前沿大模型蒸馏为参数量在 1 至 30B 之间的任务专用小模型(SLM)。其主打极高的易用性,开发者仅需 25 行代码即可完成模型蒸馏操作,大幅降低了定制和部署小模型的门槛。

2026-07-12 ~ 2026-07-13 · 2 条相关