曝 DeepSeek 仅保留四款 V4 模型,欲通过精简版本来压低推理成本
teortaxesTex · x · 2026-09-09
用户 teortaxesTex 称 DeepSeek 一贯以最小化推理成本为目标,这决定了它倾向运行尽可能少的模型类型。他列出现在同时存在的四个版本:V4-Pro-0813、V4-Flash-0731、V4-Flash-Vision-Exp 和 V4.1,并认为「是时候裁撤一些了」。被质疑时他反驳称 DeepSeek 不是 AWS,没有长期企业合同,不必照顾个别用户的用例。注意:帖子未给出官方来源,上述版本命名与裁撤计划均属未经证实的猜测。
「Infra」频道最新
- GTX 1660 Super 6GB 显卡够跑 ComfyUI 吗?作者求升级建议 — srthk97 · 2026-09-09
- 12 张 RTX 3090 跑满 285B DeepSeek-V4-Flash,解码超 120 tok/s — ciprianveg · 2026-09-09
- OpenAI 风波后,有人提议为前沿 LLM 推理建可信执行环境 — Michael_D_Moor · 2026-09-09
- 在家跑价值 1 万美元的模型:Fireworks AI 工程师分享 agent 工作流 — David Ondrej · 2026-09-09
- 传 NVIDIA 以 12.9B 美元收购 Hugging Face,ZipNN 研究立功省 20% 存储 — LChoshen · 2026-09-09
- 万级 agent 真能降算力需求?反方:10K agent 早就在干了 — bookwormengr · 2026-09-09