实测:GLM 5.3 Flash nvfp4 优于 Deepseek V4 Flash
serige · reddit · 2026-08-30
作者在 2x DGX Spark 环境下对比了 Deepseek V4 Flash 0731 和 GLM 5.3 Flash (nvfp4)。结果显示,开启 thinking 时 GLM 5.3 Flash 在 HumanEval 上得分优于 DSv4f (97% vs 93%),且 nvfp4 量化表现稳健。主要 trade-off 是上下文长度限制为 256k。
「Infra」频道最新
- Google Cloud Monitoring MCP 连接器发布 — modelcontextprotocol · 2026-09-01
- Distributed.systems发布可审计的Agent基础设施 — arthurcolle · 2026-09-01
- ChatGPT 启用记忆和历史会话是否增加 Token 消耗? — ssunki · 2026-09-01
- 工程师深挖 ROCm,修复 MI350X 推理崩溃并发现 9 个 Bug — AnushElangovan · 2026-09-01
- 40nm 神经动力学芯片:利用电导漂移实现单次迭代 2.12ms 延迟 — maier_ak · 2026-09-01
- Qwen3.8 Flash 在双 DGX 上跑出 415 tok/s — NVIDIAAI · 2026-09-01