Google 推出 Gemini 蒸馏服务,面向更小更便宜模型
ccerrato147 · x · 2026-07-29
Google 推出 Gemini 蒸馏服务早期访问版
配图显示,Google 正在提供 Gemini Distillation Service 的早期访问能力,让用户用更强的 teacher model 的输出和推理轨迹,训练更小、更高效的 student model,目标是降低延迟和成本,适配企业生产场景。
- 这项服务强调把前沿模型能力向更小模型迁移,补足“强但贵”和“够用但便宜”之间的落差。
- 不同于传统 SFT,它不仅用最终文本输出,还会利用 teacher responses 和 raw thoughts。
- 目前早期访问支持的模型是:gemini-3.1-pro 作为 teacher,gemini-2.5-flash 作为 student。
- Google 同时提醒:该服务仍处于实验阶段,暂不建议用于生产环境。
「Infra」频道最新
- 退役 NVIDIA 老卡拼出约 165 美元本地 AI 服务器 — blelbach · 2026-07-29
- 廉价本地智能将把 AI 工作负载从云端分流 — PeterDiamandis · 2026-07-29
- AI 开支与推理需求扩张,AMD 利润被看多 10 倍 — AccBalanced · 2026-07-29
- Cradle Codec 把 KV cache 压缩后经以太网跨节点传输 — knowrohit07 · 2026-07-29
- Bittensor 将 q 提至 0.75,放松中游 subnet 的发放门槛 — markjeffrey · 2026-07-29
- OpenRouter 的壁垒来自路由数据和持续迭代工具链 — mmurph · 2026-07-29