Transformer 或在做的远不止「预测下一个词」
soleio · x · 2026-08-25
Soleio 转发了一篇关于 Transformer 机制的观点文章,指出「它只是一个统计机器,预测下一个 token」是对 Transformer 最常见也最具误导性的描述之一。
文章的核心论点是:训练目标告诉你系统在优化什么,但并不必然告诉你系统为了实现目标而发现的内部计算。当研究者打开 Transformer 内部观察,同时神经科学家观察大脑神经元群体时,两者呈现出有趣的共性——这暗示模型内部可能形成了比「逐词统计」更丰富的计算结构。
「漫话AGI」频道最新
- 观点:很多创造力只是重组已知信息,AI 擅长此道 — Fowe · 2026-08-25
- Azeem 提议以“质量调整Token”衡量AI智能价值 — daniel_mac8 · 2026-08-25
- 百年前加油站也曾引发民众强烈抵制 — neil_chilson · 2026-08-25
- 探讨 AI 降本:实体商品是否因 AI 而变便宜? — Ben_Reinhardt · 2026-08-25
- 远程控制式多 Agent 架构为何胜过偏执沙盒化 — curious_vii · 2026-08-25
- 马斯克:AI 终将超越人类控制,先造者胜 — haider1 · 2026-08-25