花 20 美分测试「不会写句子」的 AI,却补上了分类器漏掉的 13 条请求

mikegiannulis · x · 2026-09-18

作者分享一次反直觉的实测:用一个连完整句子都写不好的小模型,仅花 20 美分做测试,却抓住了自家客服支持分类器漏掉的 13 条客户请求,并在检索源文档时把正确段落排到第一名的比例从 60% 提升到 90%。他的结论是:业界可能把 LLM 用错了地方——很多场景并不需要能写漂亮文章的大模型,小而专的模型在分类与检索排序这类任务上反而更便宜、更有效。

所属事件:TypeSafe 发布决策模型 Jev:不聊天、直接给答案(44 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →