Karpathy:LLM 认知核心将是极小参数模型
yacineMTB · x · 2026-08-20
Andrej Karpathy 提出了“LLM 认知核心”的概念,即一个牺牲百科知识以换取能力的几十亿参数小模型。他认为未来的模型将非常小但“思考”能力极强,通过剥离记忆力或限制记忆来提升泛化能力,避免过度依赖死记硬背。人类难以记忆的特性在此被视为一种正则化手段。
「漫话AGI」频道最新
- OpenAI「永久停用」涉事研究模型,引发模型心理创伤争论 — repligate · 2026-08-20
- 法学院不再辩论 AI 取代律师,一学期培养市场开价 32 万美元的复合人才 — jkubicki · 2026-08-20
- NYT:印度卡鲁尔市靠数据标注创造大量就业 — nordicinst · 2026-08-20
- 预测AI行业将回归未受限模型,对齐拖累发展 — Promptmethus · 2026-08-20
- 《湮灭》才是最像 AI 的电影? — curious_vii · 2026-08-20
- 若无早期文本检测器,LLM 使用规范或将大不相同 — dioscuri · 2026-08-20