质疑「小模型做评测」护城河论:大厂迟早蒸馏进自家模型
Shahules786 · x · 2026-10-08
一位开发者对监控平台以「我们有小模型专做评估与错误分析」为差异化卖点的说法表示怀疑。他 2024 年初就尝试过这条路:针对特定工作负载后训练一个小模型,确实比用前沿模型便宜很多。
但问题在于,实验室完全能把这类能力蒸馏进更便宜的通用模型(如 Astra → Luna),而且它们拥有数据、算力和内部需求持续迭代。作者认为这里的激励尤其强:研究人员在训练和数据准备全程都需要评估与错误分析,实验室自己就被这个问题困扰,因此每家实验室都有动力把这类能力内建到自己的模型里。
「公司和人」频道最新
- AI 军备竞赛:20 岁实习生薪资超多数美国人职业巅峰 — SuB8u · 2026-10-08
- UT Austin 教授招收多名博士生,方向为人本 AI 与对齐 — EliasEskin · 2026-10-08
- Google AI 基建掌门人:每瓦 goodput 是北极星指标 — samiramanabi · 2026-10-08
- 博主调侃微软 Surface 演示造假:90 秒竟没推销一次 Copilot — IsForAt · 2026-10-08
- Uber 司机拆解 OpenAI 额度重置:那不过是随时可收回的奖金 — Arqium · 2026-10-08
- Anthropic 负责任扩展官换人:Sam McCandlish 接替 Jared Kaplan — Miles_Brundage · 2026-10-08