burny 反驳 Taylor Lorenz:现代 LLM 早已不止是'预测最可能文本'

burny_tech · x · 2026-10-01

爆料人 burnytech 引用科技记者 Taylor Lorenz 的说法并指出其过时:'LLM 只是根据训练数据输出最可能的文本序列'是两年多前的旧模型认知。他说明如今模型输出分布已被基于奖励的强化学习(RL from rewards)高度塑造,还有 CoT、工具调用、RAG 等机制。被引用方也承认前沿模型确实很强,分歧在幻觉错误率能否降低。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →