GLM-5.3-Flash 上线:百万上下文仅 0.15 美元
gharik · x · 2026-08-27
DeepInfra 推出 GLM-5.3-Flash API,这是一款原生多模态模型,拥有 320B 总参数但仅激活 18B。该模型采用混合稀疏和线性注意力架构,在 100 万 token 上下文窗口中保持精度的同时大幅降低算力成本。定价为输入 0.15 美元/百万 token,支持工具调用和结构化输出。
所属事件:智谱开源 GLM-5.3-Flash:低价高能登顶性价比前沿(39 条相关)→
「模型」频道最新
- AI 进入青春期:小模型在特定领域击败大模型 — DhruvBatra_ · 2026-08-27
- TerminalBench 深度评测:GPT-5.6 领跑,多模型降级 — abeirami · 2026-08-27
- 流式转录对比:Gemini 3.5 Live 首响快于 GPT Live 且更准 — ArtificialAnlys · 2026-08-27
- 双 DGX Spark 跑通 Qwen3.8-Flash-Next — NVIDIAAI · 2026-08-27
- LLM 排行榜现新榜首,性能显著超越前代 — jonathan_wilke · 2026-08-27
- Yutori 掌门谈 Agent 上网:多数网站永远不会有 API,像素进出才是正解 — DhruvBatra_ · 2026-08-27