Qwen3.5 27B 推出 12GB 显存 GGUF 量化版
soyaakinohara · hf · 2026-08-23
Hugging Face 上出现了 Qwen3.5 系列的新量化模型 soyaakinohara/qwen3.8-27b-abliterated-3.69bpw-12GB-MTP.gguf。该模型针对 llama.cpp 进行了优化,采用 GGUF 格式。量化后的版本将显存需求控制在 12GB 左右,适合在消费级硬件上本地部署。模型被标记为“abliterated”(去安全审查)和“uncensored”,使用了混合注意力机制(hybrid-attention)和 MTP(Multi-Token Prediction)技术。
「Infra」频道最新
- 深度长文解析主流 AI 芯片架构与软件栈 — ycombinator · 2026-08-23
- Bloomberg 播客:AI 业界为何完全没料到数据中心反弹 — AccBalanced · 2026-08-23
- Hot Chips 2026 明日开幕,聚焦 AI 基础设施与 Agent 负载 — ai · 2026-08-23
- Go 语言实现进程崩溃不丢失进度的 AI Agent 长循环 — Soft_Flower5258 · 2026-08-23
- 因数据中心用电激增,爱尔兰拟考虑重启核电 — Polymarket · 2026-08-23
- 双 3090 跑通 Qwen 27B 全量上下文:3200 tok/min 实战配置 — CryptographerLow7817 · 2026-08-23