业界感叹:强指令微调、能调工具的小型非推理 LLM 没人做了
vboykis · x · 2026-09-23
Yoav Goldberg 发推指出,市场其实很需要强大的、经过指令微调、支持工具调用、不推理、不对话、小上下文的 LLM,但整个行业把这个方向丢了,希望能迎来复兴。转发者 vboykis 补充:对很多任务确实不需要推理型 LLM,能用文本定义任务并直接执行就很好;而对于重复性任务,也许还可以收集示例、微调出自己定制的小型预测器,做得更好。
「模型」频道最新
- 两个 LLM 驱动机器人格斗:GPT-6 Astra 31 秒逼退 Claude Opus 5.5 — DJiafei · 2026-09-23
- 写文章把自己写成 infohazard?用户吐槽 Opus 5.5 安全监控频繁触发 — scaling01 · 2026-09-23
- CliffCompaction 两行命令接入 Codex,开源模型压缩更优 — Tim_Dettmers · 2026-09-23
- Dettmers:CliffCompaction 配合完整思维链效果更好 — Tim_Dettmers · 2026-09-23
- Dettmers:配上 CliffCompaction,开源模型长程能力反超闭源 — Tim_Dettmers · 2026-09-23
- Dettmers 换主力:DeepSeek v4.1 长程工程任务压过 Astra — Tim_Dettmers · 2026-09-23