从 TabNine 到今天:早期 LLM 语言补全也能写代码,还要后训练吗
menhguin · x · 2026-09-20
作者 banteg 转引 2019 年 Deep TabNine 的发布推文(用约 200 万个 GitHub 文件训练的 GPT-2 代码补全模型),感慨一个老问题:编程究竟更靠语言还是逻辑?
他的观察是:早期 LLM 本质上是"语言自动补全",能力相当简单,却已经能把编程写得有模有样——这暗示编程任务对纯语言模型出奇友好。由此他抛出一个挑衅性问题:如果语言建模本身就足以支撑编程能力,我们是否根本不需要后训练(post-training)?
「漫话AGI」频道最新
- 数学家做题前得先猜:前沿实验室是不是已有人解出来了? — panickssery · 2026-09-20
- 2026 Linux 桌面之年?真相是 agent 都跑在 Linux 虚拟机里 — djcows · 2026-09-20
- AI 圈热议罗尔斯:原初位置论证的三个致命弱点 — panickssery · 2026-09-20
- AI 圈激辩意识标准:Yudkowsky 把主观体验与智力处理混为一谈 — teortaxesTex · 2026-09-20
- 另一种奇点:技术能力增速超过机构理解与治理能力的时刻 — AryHHAry · 2026-09-20
- AI 密集攻破数学难题,OpenAI 拿下 Navier-Stokes 相关问题 — burny_tech · 2026-09-20