法律垂直微调模型基准测试显著超越通用模型

Joshua Saxe 观察指出,随着开源权重模型普及和 AI 成为业务核心负载,针对法律等特定领域做后训练的模型能否在帕累托前沿上大幅超越通用模型引发讨论。帖中引用 Harvey 模型在法律基准上的实测数据,显示经过领域微调的垂直模型表现显著优于通用模型,暗示特定领域后训练或成为提升性价比的新路径。

2026-08-23 ~ 2026-08-23 · 2 条相关