NVIDIA 发布 NVFP4 量化版 Qwen3.8-Flash-Next,体积缩小 63%
_akhaliq · x · 2026-09-05
NVIDIA 在 Hugging Face 上发布了采用 NVFP4 量化的 Qwen3.8-Flash-Next:一个 125B 参数、混合注意力机制的 MoE 模型,量化后体积缩小 63%,且精度损失极小。
「模型」频道最新
- 用户吐槽 GPT-6 Astra 频繁忘记自己会用电脑和 Gmail MCP — Soft_Hand_1971 · 2026-09-05
- Eric Horvitz:Astra 模型卡显示通过思维链监控滥用正越来越难 — erichorvitz · 2026-09-05
- GPT-6 Astra 登陆 Databricks,主打智能体推理与企业文档处理 — matei_zaharia · 2026-09-05
- 网传 Astra 模型 Runescape 基准爆发,16 项技能破 10 项纪录 — scaling01 · 2026-09-05
- 两个月前被捧为 AGI 的编码模型,对比 GPT-6 Astra 高下立现 — aidan_mclau · 2026-09-05
- 网传 GPT-6 Astra 网安基准刷榜:29/32 CVE,三次测试花费近 4000 美元 — charliermarsh · 2026-09-05