Ollama 云端全面上线 DeepSeek-V4-Flash,输出速度超 120 tps
ollama · x · 2026-08-08
Ollama 宣布在其云端全面推出 DeepSeek-V4-Flash-0731,并将其设为默认模型。该模型主打高效与前沿性能,在 Ollama 云端可实现 120+ tokens/s 的输出速度,并在美国和欧洲提供零数据保留的隐私托管,支持多种编程工具的长时运行。
所属事件:DeepSeek-V4-Flash发布并全面登陆各大平台(4 条相关)→
「模型」频道最新
- 质疑AI推理能力:关闭推理模式后模型能力是否仍在提升? — inductionheads · 2026-08-08
- GPT-5.6 Sol 网络安全实战表现获好评,加速事件响应 — gdb · 2026-08-08
- OpenAI 与 ElevenLabs 宣布采用 Google SynthID 音频水印技术 — pushmeet · 2026-08-08
- DeepSeek V4 无视觉模块:模型自建亮度网格查错 — teortaxesTex · 2026-08-08
- MiniMax H3 微调遇阻:社区反映大数据集训练频繁崩溃 — Sorry_Warthog_4910 · 2026-08-08
- 网传Claude 4最大输出达38万Token,暗示上限更高 — teortaxesTex · 2026-08-08