工业寄存器表格分类惨败:Prompt 还是微调问题?

Plenty_Shine_8250 · reddit · 2026-08-21

作者构建了一个将工业通信手册转换为标准化目录的流水线,核心环节是使用 LLM 对表格进行分类和列角色映射。在测试中,Fireworks Qwen 3.7 Plus 在分类上表现尚可但过度分类,且在列映射任务上表现糟糕(F1=50%),经常遗漏列或给出错误映射(如将 bitoffset 误判为 address)。相比之下,本地 4B 模型在映射任务上反而更优。作者分析原因可能在于 JSON Schema 指令与模型思维模式的冲突,并探讨这究竟是 Prompt/Schema 设计问题,还是必须转向微调。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →