一张被反复引用的图表:别再把 LLM 当成下一词预测器
burny_tech · x · 2026-10-11
有开发者转发称,Fchollet 分享的一张图表近两周被自己至少用了三次,用来说服朋友别再认为现代 LLM 只是「下一词预测器」、只会复述预训练语料。
图表本身未在正文中展开,但这条讨论折射出 AI 圈对 LLM 能力边界的持续争论:一种观点坚持「LLM 只是大语料复读机」,而这张图被用来反驳该看法。
「模型」频道最新
- 研究者发论文难:让 Qwen 2.5「精神崩溃」实验无法上 arXiv — IndraVahan · 2026-10-11
- 博主称未进 CVP/Daybreak 者,最强网络安全模型是中国的 GLM 5.3 — zephyr_z9 · 2026-10-11
- 网友猜 Claude 乱语减少因 RL 限制了 KL 散度 — burny_tech · 2026-10-11
- 20年工程师实测:Qwen3.8本地写码胜Gemma4,GPT-6.1仍是另一档 — therealjerseytom · 2026-10-11
- 传 Google 内部模型 Carbon 强于待发布 Gemini,员工纷纷倒戈 — bindureddy · 2026-10-11
- AIandDesign 征集案例:你有没有被 Claude 主动结束过对话? — AIandDesign · 2026-10-11