MiniMax H3 编码器疑泄露,开发者指低精度量化牺牲提示词遵循
ayakitodev · reddit · 2026-08-03
MiniMax 尚未正式发布的 H3 模型疑似泄露了其文本编码器组件(Qwen3-VL-32B-Instruct)。这引发了社区关于文本编码器精度对多模态模型影响的讨论。
发帖者指出,许多开源模型用户习惯使用最小的量化版本(如 FP4)以节省显存,但这严重影响了模型对复杂提示词的遵循能力。根据他的测试,FP8-mixed 是准确率和体积之间最佳的平衡点。
他认为,受限于本地 GPU 算力,开源社区往往被迫妥协于文本编码器的思考与理解能力,这正逐渐成为开源与闭源模型之间的一大核心差异。
「模型」频道最新
- LLM 掉入常识陷阱:显性数据致推理失效,最优模型也难幸免 — rohanpaul_ai · 2026-08-03
- 开发者用 GLM 5.2 辅助开发完整网页游戏 — ex-arman68 · 2026-08-03
- 曝 OpenAI Codex 内置 GPT-5.6 Luna Max,成本仅为 Sol 数分之一 — DeryaTR_ · 2026-08-03
- 实验证明现有大模型能力过剩,可复现 Astra 级效果 — danshipper · 2026-08-03
- 对大模型粗鲁提问能省Token?研究称语气影响44%推理成本 — rohanpaul_ai · 2026-08-03
- 实测 ChatGPT 指导装机翻车:免费版能力遭质疑 — Kyokyodoka · 2026-08-03