M3 Max 本地实测:32K 任务后仍余 20GB 显存
mayfer · x · 2026-08-31
用户在 M3 Max (128GB) 上本地运行 Agent 进行了实测。结果显示,推理速度达到 70 tok/s,Prefill 约为 300 tok/s。在完成一个 32K token 的长任务后,系统仍有 20GB 内存可用,表明本地运行大上下文 Agent 在该硬件配置下具备良好的可行性。
「编程与Agent」频道最新
- Arctron AI 更新:提升视觉精度,支持 WebMCP — jasonkneen · 2026-08-31
- Shipstatic 发布 MCP 服务器,让 Agent 部署管理静态站点 — modelcontextprotocol · 2026-08-31
- 新 MCP 连接器赋能 Agent 执行基础设施管理任务 — modelcontextprotocol · 2026-08-31
- LLM 批量改公式时,仅看汇总页无法验证正确性 — saimatrixxx · 2026-08-31
- 构建生产级 AI Agent:从 400+ 实践中提炼的 12 层工程栈 — MaryamMiradi · 2026-08-31
- 用不同模型分工:Luna 采信、Sol 编码、Fable 规划 — MilesCranmer · 2026-08-31