构建波兰法律模型:50B+ 低激活 MoE 是否值得换掉 27B 稠密模型?

SignificantZebra5883 · reddit · 2026-09-29

一位开发者正在构建面向 B2C 的波兰语通用法律模型(起草文书、引用法律来源问答、附带自动化编码能力),工作流高度依赖工具调用,类似 Claude Code 的执行模式。他已用 27B 稠密 Qwen 3 定制微调在法律文书摘要与分类上取得不错效果。

现在他在纠结是否升级到 50B+ 总参数、低激活参数的 MoE(如 70-120B 档),核心疑问包括:

微调目标是波兰语、文书惯例和成功的工具调用轨迹,法律条文本身留在检索/工具层而非靠记忆。他不想只要模型清单,更想要「模型+量化+GPU+推理引擎+上下文长度+并发+实测延迟」的一手配置经验和从 30B 升级到 MoE 后 agent 每分钟成功任务数是否真提升的实证。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →