NVIDIA Groq 3 LPX 实现长上下文极速交互
frozenport · hn · 2026-08-25
NVIDIA 发布了 Groq 3 LPX 架构,旨在解锁 NVIDIA Vera Rubin 平台上的超快长上下文交互能力。该技术重点解决了长文本处理中的延迟问题,提升响应速度。
「Infra」频道最新
- Zai 开源 320B 模型 GLM-5.3,宣称全流程纯国产芯 — SumitGup · 2026-08-27
- 博主承认对英伟达数据理解有误 — EigenGender · 2026-08-27
- 英伟达数据为年化值,每季增 250 亿 — cis_female · 2026-08-27
- 英伟达 Q2 并未额外创造 1000 亿美元价值 — EigenGender · 2026-08-27
- 业界对 CPU 节点的兴趣近期显著回升 — Sethwinterroth · 2026-08-27
- llama.cpp 新增对 Nanbeige4.2-3B 模型的支持 — pmttyji · 2026-08-27