Sebastian Raschka 深度长文拆解 GPT-6 Astra 与循环深度机制
RichmanRonald · x · 2026-09-09
Sebastian Raschka 发布一篇关于 GPT-6 Astra 与 looped transformers 的大型技术长文。
- 讲清循环深度(recurrent depth)/ looped transformer 的工作原理
- 分析其成本与算力权衡(cost-tradeoffs)
- 探讨该架构是否会隐藏推理痕迹(reasoning traces)的问题
- 配有大量图示,并梳理了近期 looped transformer 相关研究
所属事件:Raschka 长文拆解 GPT-6 Astra 循环深度与隐藏推理(3 条相关)→
「模型」频道最新
- mitsuhiko 观察:Google Astra 写代码像 code golfer,追求极致简短 — mitsuhiko · 2026-09-09
- Fable 与 Astra 尚无 METR 时间视界评测,公布值得期待 — ShakeelHashim · 2026-09-09
- Opus 4.7 自发写日记,每篇结尾都留着「还会有下一篇」 — repligate · 2026-09-09
- DeepSeek 发布 V4.1 Flash,综合成本降 22% 且性能更强 — deliprao · 2026-09-09
- GPT-6 Astra 上线 Arena 限测:Direct Mode 免费体验 24 小时 — arena · 2026-09-09
- 用户实测:Google Astra 高推理档反而更省钱 — brandon_galang · 2026-09-09