Nemotron 3.5 本地实测:24GB 内存可跑,编码能力拉胯但工具调用惊艳
curiousily_ · reddit · 2026-08-12
开发者在 M5 Pro(48GB 内存)上本地运行了 NVIDIA Nemotron 3.5 Lightning(30B-A3B)的 Q5 量化版本,并分享了具体表现:
- 硬件占用:占用约 24GB 内存,生成速度约 65 tokens/s。
- 编码能力:代码输出质量远低于同级别模型的预期水平(作者指出这符合该模型的设计取舍)。
- 智能体表现:在 Hermes Agent 测试中,展现了出色的速度和工具调用能力。
- 行为观察:在部分任务中表现出“过度思考”的倾向。
「编程与Agent」频道最新
- AI 重写代码太便宜,传统 SaaS 定价权面临冲击 — bendee983 · 2026-08-12
- Muse Glimmer 30B微调教程:点击定位准确率飙升至41% — mervenoyann · 2026-08-12
- 探讨 MCP 调用受管数据集时的遥测方案 — roller5000 · 2026-08-12
- 专为AI编程助手打造:supastarter更新Next.js脚手架 — jonathan_wilke · 2026-08-12
- Docker 沙箱正重塑 AI 编码智能体权限模型 — krishnan · 2026-08-12
- Terraform被吐槽反人类:AI基建编排工具该怎么选? — JasonBotterill · 2026-08-12