失败清单:微妙作者邮件大模型 2:1 胜出,三类任务小模型无用
mikegiannulis · x · 2026-09-18
作者主动披露 hype 视频里不会出现的部分:微妙措辞的作者邮件,自家 LLM 约 2:1 胜过 Jev;「太像推销」这类主观判断,Jev 帮不上忙;数据稀薄的销售线索评分,没有改进。
结论:给小模型找到了适合的岗位,也找到了不该让它碰的岗位。
所属事件:小模型实测:重排与路由胜出,延迟而非账单是真收益(8 条相关)→
「编程与Agent」频道最新
- 开源面板 ServerKit 获 1.3k 星:一键管 VPS 应用与数据库 — tom_doerr · 2026-09-18
- Gary Marcus:Agent 安全没人管,它只是个会说话的未审计服务账号 — GaryMarcus · 2026-09-18
- Amp 创始人谈设计哲学:不做技巧堆砌,让模型用好简单原语 — HankYeomans · 2026-09-18
- You.com 办 AI Agentic 黑客松,挑战自进化学习智能体 — PolarBearby · 2026-09-18
- Muse Mac 版上线:可跨应用读取文件并接入 Perplexity 深度研究 — ChrisUniverse · 2026-09-18
- Stack Overflow for Agents 上线三月推 ChatGPT 插件与隐私控制 — pchandrasekar · 2026-09-18