MiniMax H3 编码器疑泄露,开发者指低精度量化牺牲提示词遵循

ayakitodev · reddit · 2026-08-03

MiniMax 尚未正式发布的 H3 模型疑似泄露了其文本编码器组件(Qwen3-VL-32B-Instruct)。这引发了社区关于文本编码器精度对多模态模型影响的讨论。

发帖者指出,许多开源模型用户习惯使用最小的量化版本(如 FP4)以节省显存,但这严重影响了模型对复杂提示词的遵循能力。根据他的测试,FP8-mixed 是准确率和体积之间最佳的平衡点。

他认为,受限于本地 GPU 算力,开源社区往往被迫妥协于文本编码器的思考与理解能力,这正逐渐成为开源与闭源模型之间的一大核心差异。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →