GLM 5.3实测:Prefill约1 ktok/s,输出60 tok/s,性能超预期
yacineMTB · x · 2026-08-14
Tim Dettmers实测GLM 5.3,Prefill约1 ktok/s,思考/输出约60 tok/s。在完整思考轨迹下,GLM 5.2已优于Fable+Claude Code,而GLM 5.3更精准简洁,正在测试长任务性能。
「模型」频道最新
- Liquid AI 发布 LFM2.5 编码器:一次识别 16 种语言中的 40 类 PII — helloiamleonie · 2026-08-14
- 开发者盛赞 Gemini 3.7 Flash:低延迟就是能力,迭代开发利器 — fofrAI · 2026-08-14
- 一文看懂LLM四种训练方法:从因果语言建模到标记分类 — goyalshaliniuk · 2026-08-14
- Qwen3.5-9B量化新SOTA:31胜0负,KLD提升23% — KvAk_AKPlaysYT · 2026-08-14
- Mistral转型为中国开源模型推理服务商,旗舰模型架构与DeepSeek相似 — SumitGup · 2026-08-14
- Cohere 开源模型下载破 15 万,可经 OpenRouter 或本地运行 — cohere · 2026-08-14