DeepSeek-V4-Flash 参数与跑分曝光:284B MoE 架构,支持 1M 上下文
ollama · x · 2026-08-05
Ollama 页面披露了 DeepSeek-V4-Flash 的详细规格与评测数据。该模型总参数量达 284B,激活参数为 13B,采用混合专家架构,支持高达 100 万 tokens 的上下文窗口。
模型提供三种思考模式:无思考、思考与最大思考。跑分显示,其 Max 思考模式在 LiveCodeBench 和 HLE 等测试中表现优异,而 V4-Pro 版本在多项指标上进一步突破。
所属事件:DeepSeek-V4-Flash 登顶 Ollama 增速榜首(2 条相关)→
「模型」频道最新
- DeepSeek V4 Flash 疑现身:284B总参数,1M上下文 — MikePFrank · 2026-08-05
- 网友实测 Minimax H3 模型:单行提示词生成绝美代码 — CSProfKGD · 2026-08-05
- Claude 新模型陷反差:复杂任务变强,日常使用却变啰嗦 — generativist · 2026-08-05
- 受廉价中国模型冲击,大模型 Token 价格正历史性暴跌 — ccerrato147 · 2026-08-05
- 传 xAI 将把 SpaceX 全量数据喂给 Grok,年底剑指百亿美元 ARR — ns123abc · 2026-08-05
- 白宫AI新规:美国开源模型豁免政府审查 — realmvp77 · 2026-08-05