Latent Space AI 日报:xAI 推出 Grok 4.6 及多模型混战
Latent Space · rss · 2026-08-13
本期 Latent Space AI 日报涵盖了大量前沿模型发布与生态更新:
- xAI Grok 4.6:发布 1.5T 参数模型,主打长周期智能体与视觉交互。在性价比上达到前沿水平,Terminal-Bench 表现优异,价格远低于同梯队模型。Elon 透露 Grok 4.7 已开始训练。
- 开源与前沿模型混战:阿里开源 Qwen3.8-Max(2.4T MoE),主打长上下文但暂缺视觉能力;DeepSeek V4 Pro GA 以极低价格(约 0.435$/M 输入)入局,比部分竞品便宜数十倍;微软发布首个自研推理模型 MAI-Thinking-1。
- 多模态与端侧:LTX-2.5 开源视频栈升级,支持联合音频生成;Cohere 发布轻量级 VLM North Micro Vision;Google DeepMind 推出手语转文字系统 SL2T。
- 推理与压缩基建:vLLM 增加了对 Azure Blob 和巨型模型的支持;LLM Compressor 新增 MoE 专家剪枝与任意精度量化功能,进一步降低大模型部署门槛。
「Infra」频道最新
- 生产环境中的 vLLM 升级踩坑:测试为何总是漏掉回归 Bug? — Pretend_Mine_3659 · 2026-08-13
- 从智力到性价比:大模型核心评估指标的演进路线 — beffjezos · 2026-08-13
- 曝 Anthropic 拟 60 亿美元收购 Decart,加码高效 AI 基础设施 — nmasc_ · 2026-08-13
- 浣熊与垃圾箱:一则关于本地 AI 推理与 MoE 架构的隐喻 — GrayRoberts · 2026-08-13
- 去中心化 AI 推理为何屡战屡败?剖析核心的信任与陷阱 — 0xJeff · 2026-08-13
- 追踪数月定位宕机元凶,Tailscale 揪出隐藏 16 年的 SQLite Bug — steipete · 2026-08-13