Ollama 云端上线 DeepSeek-V4-Flash,输出超 120 tps

zhyncs42 · x · 2026-08-11

Ollama 宣布其云平台已全面上线 DeepSeek-V4-Flash 模型。该模型主打速度、效率与前沿性能,在 Ollama 云端可实现 120+ tokens/s 的生成速度。

该模型采用开放权重,提供美国和欧洲的数据托管服务,并承诺零数据留存。目前 Pro 和 Max 计划用户可享受充足的使用额度,以支持长时间不间断的编程辅助等任务。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →