超越 Transformer 架构今年将成主流,MoE 与线性受关注
PeterDiamandis · x · 2026-08-22
Peter Diamandis 转发观点称,业界共识是超越 Transformer 的新架构今年将占据重要市场份额。重点提及的技术包括混合专家、扩散 Transformer、线性注意力与循环机制,这些正在解构“Attention Is All You Need”的原始假设。LiquidAI 等实践证明了新架构的可发现性,传统 Transformer 在效率上的短板正促使架构多样化。
「模型」频道最新
- RTX A2000 运行 Qwen 3.8:求最佳量化配置 — MrMrsPotts · 2026-08-22
- Qwen3.8 推理太慢,作者怀念 QwQ 到 Qwen3 的时代 — ForsookComparison · 2026-08-22
- 实测 DeepSeek-Vision:千字文本压缩至 330 token — teortaxesTex · 2026-08-22
- OpenAI 宣布 GPT-5.6 Sol 价格下调超 20%,为期 3 个月 — soumitrashukla9 · 2026-08-22
- 通过 System Prompt 让 ox-alpha 自称 GLM? — Afinetheorem · 2026-08-22
- Grok 4.6 登顶 CursorBench,成本竞品仅 1/6 — elonmusk · 2026-08-22