PDF 翻译器卡 70% 准确率:如何防止 LLM 乱改数字?

Nervous_Classroom714 · reddit · 2026-08-31

作者在开发 PDF 翻译器时遇到 70% 质量评分瓶颈,核心问题是模型会篡改句子中的数字(如小数点格式化、本地化)。尽管已预先提取并锁定数字,但在句内仍失效。作者尝试了从源 PDF 而非转换文本提取 token、小批次翻译、术语表一致性检查等方法。当前疑问包括:句内数字的保护 Prompt 模式、批次大小与上下文质量的平衡、以及如何处理模型回源(Echoed)段落的阈值判断。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →