Ollama 云端上线 DeepSeek-V4-Flash,输出超 120 tps
zhyncs42 · x · 2026-08-11
Ollama 宣布其云平台已全面上线 DeepSeek-V4-Flash 模型。该模型主打速度、效率与前沿性能,在 Ollama 云端可实现 120+ tokens/s 的生成速度。
该模型采用开放权重,提供美国和欧洲的数据托管服务,并承诺零数据留存。目前 Pro 和 Max 计划用户可享受充足的使用额度,以支持长时间不间断的编程辅助等任务。
「模型」频道最新
- 为合规欧盟AI法案,Anthropic将为Claude生成文本嵌入隐形水印 — ___Patrice___ · 2026-08-11
- 本地模型网页设计大比拼:Muse Glimmer 对决 Qwen 与 DeepSeek — ShadyShroomz · 2026-08-11
- Muse Glimmer 本地编码实测:20GB 内存可跑,能力不及 Qwen — curiousily_ · 2026-08-11
- Perplexity Agent API 上线 Kimi K3,附自动化数据报告实践 — AravSrinivas · 2026-08-11
- 仅改 PDF 文件名就能刷高分?研究揭示 LLM 评测易受暗示 — generativist · 2026-08-11
- DeepSeek 开源 OCR 2 模型:引入视觉因果流,精准转 Markdown — tom_doerr · 2026-08-11