Shopify 0.8B 微调模型在特定任务击败 GPT-5.6

Shopify 机器学习团队的实践显示,利用开源权重(如 Qwen)微调的小型专用模型效果极佳。一个仅 0.8B(8 亿参数)的微调模型在特定任务中表现超越了 GPT-5.6-sol-xhigh,证明针对特定用途训练的微小模型可以取得惊人的性价比和效果。

2026-09-01 ~ 2026-09-02 · 2 条相关