SAM 3.1 量化至 INT4:显存直降 40% 且画质无损
External_Quarter · reddit · 2026-07-31
开发者将 SAM 3.1 模型量化为 INT8 和 INT4 版本,且保持与原生加载器兼容。其中,INT4 版本相比 fp16 检查点体积减小近 40%,可节省约 600MB 显存,且分割掩码质量几乎一致。虽然推理速度仅略有提升,但原版 SAM 的速度已经足够快。
所属事件:SAM 3.1量化版发布,显存占用大降且画质无损(2 条相关)→
「模型」频道最新
- GPT 5.6 Luna 性价比反超:比 Google 最强更聪明,比最便宜更便宜 — Rare_Bunch4348 · 2026-07-31
- DeepSeek 编程成本仅 GPT Luna 三分之一:实测算力与 Token 消耗账本 — auto_off · 2026-07-31
- 中国大模型崛起:性能比肩美国旗舰,成本大幅领先 — repbre · 2026-07-31
- DeepSeek-V4-Flash 仓库惊现 Hugging Face,支持百万 Token — NielsRogge · 2026-07-31
- 实测 DeepSeek-V4-Flash 智能体:3D 任务成本仅 0.07 美元 — cedric_chee · 2026-07-31
- DeepSeek-V4-Flash-0731 模型权重正式开源发布 — shing3232 · 2026-07-31