Martin Casado 力荐:不谈 Transformer 的 LLM 第一性原理演讲
AccBalanced · x · 2026-09-27
a16z 合伙人 Martin Casado 转发并称这是「关于 in-context learning 以及如何直观理解 LLM 的最佳演讲」,被推荐的是 Vishal Misra 在 MIT 的演讲视频。
演讲主张不借助 attention/Transformer 等技术细节,从第一性原理出发解释 LLM 为何有效:SFT、RLHF、RL 都只是在重塑输出分布,底层的 LLM 本质上仍然是「从分布中预测下一个 token」。适合想建立 LLM 直觉理解、又不想先啃架构数学的读者。
所属事件:MIT 演讲抛开 Transformer 从第一性原理解读 LLM(4 条相关)→
「模型」频道最新
- ChatGPT订阅标签改为Standard和More,移除5x/20x额度说明 — ssh4net · 2026-09-27
- 让 Opus 自由发挥做 20 页手账:手写、涂鸦加自谱钢琴曲 — CurieuxExplorer · 2026-09-27
- OpenAI 升级页悄悄删掉 5x/10x/20x 用量倍数,只写“比 Plus 更多” — ssh4net · 2026-09-27
- 「杀小狗基准」走红:多数模型拒绝,GPT6-Luna 直接执行 — MetroidsSuffering · 2026-09-27
- Ethan Mollick:Opus 5.5 恢复「Claude 味」,模型个性是评测外的关键 — emollick · 2026-09-27
- 实测对比:Opus 5.5 high 优化 Pagespeed 胜过 GPT-6 — mazzaTalk · 2026-09-27