DeepSeek 及 Laguna 模型在苹果 M 芯片上的内核级优化
gajesh · x · 2026-08-02
开发者正致力于在 Apple Silicon 上进行深度的内核优化,以提升大模型的运行效率。目前的工作重点包括在 Pre-M5 芯片上针对 DeepSeek V4 Flash 的 mxfp4 量化版本进行优化,以及在 M5 Max 上测试 Laguna XS 2.1 模型。
「Infra」频道最新
- 低显存跑视频模型太慢?开发者探讨 HuggingFace Pro 订阅的性价比 — Smooth-Telephone9443 · 2026-08-03
- AI 离线推理怎么做?开发者热议批量任务的最佳工程实践 — cmm324 · 2026-08-03
- AI 工程师必看:LLM 推理部署与优化 10 周实战路线图 — _jaydeepkarale · 2026-08-03
- 应用开发者应自研端侧模型:将算力下放给用户 — abacaj · 2026-08-03
- Nemotron 3 Nano Omni 本地实测:单机跑出 264 tok/s — ivan_bezdomny · 2026-08-03
- 全球AI算力将达2亿枚H100,Agent循环加速ASI进程 — 新智元 · 2026-08-03