Raschka 深度解读 GPT-6 Astra 循环架构与隐藏思维链争议

Sebastian Raschka 发布长文解析 OpenAI 新模型 GPT-6 Astra,聚焦其与循环深度 transformer(looped transformer)架构研究的关联。针对 GPT-6 Astra 发布前 TheInformation 关于「循环深度会让推理过程不可见」的报道及后续讨论,Raschka 提出不同看法,认为 Astra 的循环 Transformer 并非导致隐藏思维链的元凶,为理解该模型的架构设计提供了技术视角。

2026-09-14 ~ 2026-09-15 · 2 条相关

事件全程(共 4 集)→