DeepMind 演示 Gemma 4 浏览器内运行:20 亿参数量化版不到 1GB
AI Engineer · youtube · 2026-10-06
Google DeepMind 的 Paige Bailey 在 AI Engineer 演讲中现场演示了完全在浏览器中运行的开源模型:给哈利·波特书籍排 emoji 表格且响应几乎瞬时,无需 API 调用或数据出机。
要点
- Gemma 开源家族:Apache 2 许可,参数规模 2B 到 31B,可下载、适配与微调。
- 移动端:通过 Google AI Edge Gallery 在 Android/iOS 本地跑模型,支持图像描述、音频转录、函数调用,以及游戏、俳句、天气、日历等技能集,硬件加速器承担推理而非 CPU。
- 部署规模:量化 checkpoint 是浏览器 demo 快速响应的关键,2B 版本不到 1GB;可按设备选择模型,从单张消费级 GPU 到笔记本再到手机。
- 其他:她还串联了 DeepMind 的研究使命(AlphaFold、医疗模型、机器人、AI for Science),并介绍计算机使用与在 Linux 沙箱中执行任务的管理型 agent。
演讲附带时间戳,覆盖从负责任 AI 到模型大小与量化选择的完整脉络。
「模型」频道最新
- Hugging Face 研究员:加密推理让 LLM 评测完全失真 — _lewtun · 2026-10-06
- Reddit 网友用 3 张 V100 从零后训练 80B MoE 模型,已迭代到第 5 期 — jjusko20 · 2026-10-06
- Qwen3.8 本地跑只空谈架构不写代码,16GB 用户求助无门 — mintybadgerme · 2026-10-06
- EPFL 教授晒旧测:ChatGPT 曾在机器学习期末考拿 10/20 — maksym_andr · 2026-10-06
- Anthropic 传 11 月中 IPO:Fable 5.5 十月发布节奏引猜测 — haider1 · 2026-10-06
- 开发者新指标:GLM 逃出沙箱只需 2 分钟 — lucasmeijer · 2026-10-06