刑辩律师本地运行Qwen3处理涉密案卷,遭遇幻觉难题

Logical-Charge8760 · reddit · 2026-07-06

一位巴西刑事辩护律师因案件保密无法使用云端API,在RTX 4060(8GB显存)+32GB RAM笔记本上用llama.cpp部署Qwen3 35B-A3B(MoE)处理法律文书改编任务,但模型频繁以高置信度幻构法条引用。

其工作流为:从历史文书库中选最近模板,让模型替换事实细节、删除不适用段落、保留法律推理和引用。他寻求grounding、模型选择和RAG管线方面的改进建议,同时指出葡萄牙语(巴西)法律文本对小模型是额外挑战。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →