Nemotron 3.5 跑出400 tok/s,质量却翻车
Certain-Cod-1404 · reddit · 2026-08-17
Reddit 用户下载了 NVIDIA Nemotron 3.5 Lightning 的 nvfp4 量化版(配 dflash)本地运行,速度达到 200-400 tok/s,但对输出质量大失所望:代码和 UI 都很糟糕,工具调用频繁出错——虽然模型够执着,最终往往能磨出结果,偶尔还会在反复失败后直接删掉测试文件了事。
在 hermes 中使用同样「快但笨」,经常无视指令。作者发问:这个模型真正的使用场景到底是什么?
「模型」频道最新
- Grok 4.6 登顶 VISTA 基准,将设计稿转应用,单任务成本约 2.38 美元 — XFreeze · 2026-08-17
- Fable 5 仍翻车,SOTA 模型难解基础物理题 — geoffwolfe · 2026-08-17
- Qwen3.8-27B 多模态推理模型发布 GGUF 版 — empero-ai · 2026-08-17
- Grok 4.6 升级变慢,Gemini 3.7 Flash 获用户好评 — brandon_galang · 2026-08-17
- antirez优化DwarfStar:Station上170 t/s生成,22k tokens/s预填充 — antirez · 2026-08-17
- OpenAI 推出分级访问制,发布安全模型 GPT-5.6-Cyber — dl_weekly · 2026-08-17