Mac mini 实测:35B 本地运行时达 Haiku 水准,但不适合 Agent

PawelHuryn · x · 2026-09-10

作者澄清:这是一个本地运行时而非新模型。35B 是 Qwen3.5-MoE 35B-A3B 的 int4 版,8B 是 Ling 3.0 tiny,仅支持 MoE,且要用自己模型需先训练 prerouter 和 LoRA 适配器。

在 Mac mini M4 Pro 上的实测:

官方称「尚未针对 agentic 任务优化」:3.3k 提示词首 token 需约 30 秒,长上下文内存会远超宣称的 3 GB。适合在小内存 Mac 上做保护隐私的一次性本地任务。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →