Poolside 发布 118B 开权重编程模型 Laguna S 2.1

AI 编程公司 Poolside 发布了最新一代开权重编码模型 Laguna S 2.1。该模型专为代理编程和长周期任务设计,凭借超长上下文支持和在多项基准测试中的优异表现,发布后迅速登顶 Hugging Face 热门榜单。

已确认

Laguna S 2.1 采用稀疏混合专家架构,总参数量为 118B,每个 token 激活 8B 参数。模型支持高达 100 万 token 的上下文,并提供 thinking / no-thinking 两种模式。该模型采用 OpenMDW 许可协议开放权重,基于 Transformers 架构并支持 vLLM 部署。Poolside 官方强调,该模型在长链路任务中能保持稳定表现,且在代理编程能力上超越了部分体量更大的模型。在性能方面,官方公布其在 Terminal-Bench 2.1 基准测试中取得了 70.2 分,媲美甚至超越了体积比它大 5 到 25 倍的模型。凭借 MoE 架构带来的低激活参数,该模型在单台 NVIDIA DGX 设备上即可高效运行,并已在 SGLang 上实现 day-0 支持。据作者 @benburtenshaw 介绍,Laguna S 2.1 已经可以通过相应的 fork 在 llama.cpp 中本地运行,用户能够直接加载量化格式的模型文件。此外,关于该模型的构建周期,作者 @Madisonkanna 透露仅耗时 8 周,而 @nathanbenaich 则提及为 9 周。

为什么重要

Laguna S 2.1 的发布不仅是推出一个性能强劲的新模型,更引发了关于“美国开源 AI 路线”与“开源权重经济学”的深度探讨。据作者 @Madisonkanna 在相关访谈中指出,这触及了“谁有资格去构建智能”这一更宏大的行业议题。其出色的本地推理效率为开发者的实际部署与测试提供了极大便利。

2026-07-22 ~ 2026-07-23 · 35 条相关

事件全程(共 2 集)→

一手来源

另有 5 条近重复转述:Madisonkanna · baseten · Madisonkanna · ivan_bezdomny · nathanbenaich