DeepSeek-V4-Flash 仓库惊现 Hugging Face,支持百万 Token
NielsRogge · x · 2026-07-31
Hugging Face 上出现了一个名为 deepseek-ai/DeepSeek-V4-Flash-0731 的模型仓库,引发社区热议。从页面元数据泄露的信息来看:
- 新架构与特性:标签显示为 deepseekv4,支持 8-bit 与 fp8 精度。
- 超长上下文:关联论文指向《DeepSeek-V4: Towards Highly Efficient Million-Token Context Intelligence》,暗示该模型主打百万级 Token 的高效处理能力。
- 开源协议:采用 MIT License。
目前权重文件尚未完全开放,但已有数十个点赞。
所属事件:DeepSeek-V4-Flash 元数据泄露主打百万上下文(2 条相关)→
「模型」频道最新
- GPT 5.6 Luna 性价比反超:比 Google 最强更聪明,比最便宜更便宜 — Rare_Bunch4348 · 2026-07-31
- DeepSeek 编程成本仅 GPT Luna 三分之一:实测算力与 Token 消耗账本 — auto_off · 2026-07-31
- 中国大模型崛起:性能比肩美国旗舰,成本大幅领先 — repbre · 2026-07-31
- 实测 DeepSeek-V4-Flash 智能体:3D 任务成本仅 0.07 美元 — cedric_chee · 2026-07-31
- DeepSeek-V4-Flash-0731 模型权重正式开源发布 — shing3232 · 2026-07-31
- Kimi K3 与 GLM 5.2 潜力前瞻:强化学习或带来性能飞跃 — airesearch12 · 2026-07-31