Swift-1.5-Qwen3.8-27B 量化版冲上 Hugging Face 热榜
ukisai · hf · 2026-09-27
- 基于推理模型 Qwen3.8 27B 的 Swift-1.5 发布 GGUF 量化版本,主打 llama.cpp 本地部署。
- 模型强调 token 高效(token-efficient)与「高效思考」:通过 GSQ 与 RCO 后训练方法,让推理模型用更少 token 完成推理。
- 目前已在 Hugging Face 热门模型榜上升,适合追求本地部署与低推理成本的场景。
「Infra」频道最新
- Nix 作者社区推 Casita:面向 Agent 时代的 Rust 重写包存储 — letandrewcook · 2026-09-28
- 传中国考虑放行字节跳动与阿里恢复采购新款英伟达芯片 — Polymarket · 2026-09-27
- SpaceX CFO 称 AI 是 Starlink 需求暴增主因,星链或成轨道算力层 — elonmusk · 2026-09-27
- 玩家组四卡 RTX PRO 6000 塔式机,275W 功耗墙压温 80°C 以下 — TheZachMueller · 2026-09-27
- MLX-Serve 27B 推理提速:分支猜测一次验证,较上版快 32% — TheMoonMidas · 2026-09-27
- 哈佛免费开放 CS249r:从芯片到推理的全栈 ML 系统课 — techNmak · 2026-09-27