同个模型三个样?编程、对话、考试能力训练各不相同

lateinteraction · x · 2026-09-19

作者指出人们在讨论 LLM 能力时常混淆三个不同的问题:让模型擅长程序化调用(programmatic use)的抽象层与训练方式,和让它擅长面向用户的交互、擅长应试答题的训练,是三件很不一样的事。

这条是对 Nabeel Quazy 观点的回应:个人小项目里 LLM 表现得像个天才,一旦部署到混乱的真实环境就蠢得离谱——正是因为两种场景依赖的能力训练路径并不相同。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →