失败清单:微妙作者邮件大模型 2:1 胜出,三类任务小模型无用

mikegiannulis · x · 2026-09-18

作者主动披露 hype 视频里不会出现的部分:微妙措辞的作者邮件,自家 LLM 约 2:1 胜过 Jev;「太像推销」这类主观判断,Jev 帮不上忙;数据稀薄的销售线索评分,没有改进。

结论:给小模型找到了适合的岗位,也找到了不该让它碰的岗位。

所属事件:小模型实测:重排与路由胜出,延迟而非账单是真收益(8 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →