从 TabNine 到今天:早期 LLM 语言补全也能写代码,还要后训练吗

menhguin · x · 2026-09-20

作者 banteg 转引 2019 年 Deep TabNine 的发布推文(用约 200 万个 GitHub 文件训练的 GPT-2 代码补全模型),感慨一个老问题:编程究竟更靠语言还是逻辑?

他的观察是:早期 LLM 本质上是"语言自动补全",能力相当简单,却已经能把编程写得有模有样——这暗示编程任务对纯语言模型出奇友好。由此他抛出一个挑衅性问题:如果语言建模本身就足以支撑编程能力,我们是否根本不需要后训练(post-training)?

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →