新架构模型上下文窗口大幅超越 Transformer
thesaraharminta · x · 2026-08-25
初创公司 Accelerated Understanding 走出隐身模式,发布基于神经算子(Neural Operators)的非 Transformer 架构新模型。该模型宣称拥有比当前技术大得多的上下文窗口,旨在解决长上下文处理问题。
「模型」频道最新
- IBM Granite 4.2 登陆 Ollama:3B/8B/30B 三规格开源企业智能体模型 — krvarshney · 2026-08-26
- 黄仁勋赠 DGX Station,Perplexity 演示本地跑前沿模型 — AravSrinivas · 2026-08-25
- Polymarket盘口:Anthropic两周内发布新模型概率74% — Polymarket · 2026-08-25
- 实测发现:Qwen 小模型低成本匹敌 Claude — Ok-Challenge-7810 · 2026-08-25
- 传闻中的超大上下文新模型:创企将用神经算子架构发布 — McDonaghMatthew · 2026-08-25
- 前 NVIDIA 科学家创企发布物理预测模型,单次处理 5 万亿数据点 — thesaraharminta · 2026-08-25