Poolside 公布 Laguna S 2.1 基座模型细节
cephaloform · x · 2026-07-22
这是 Laguna S 2.1 base 的模型卡信息:它是 Laguna S 2.1 的预训练底座模型,规模和结构都给得很具体。
- 118B 总参数,按 token 计算大约 8B 激活参数。
- 48 层里交错使用 full attention 和 sliding-window attention。
- 采用 256 个 routed experts + 1 个 shared expert 的 MoE 架构。
- 这个 base model 不公开开放下载,研究者需要通过 [email protected] 申请。
- 官方还特别说明:它没有做 instruction tuning,也没有 chat / reasoning / tool-calling 能力;这些能力在 Laguna S 2.1 里。
这条信息的重点是模型架构和可用性,而不是应用层产品。
所属事件:Poolside 发布 118B 开权重编程模型 Laguna S 2.1(35 条相关)→
「模型」频道最新
- 同题 Echo Maze 实测:三大模型看似成功,代码里藏着同一个 bug — eyishazyer · 2026-09-11
- 新基准一出分数暴跌 70 点:「刷榜」现象如何让跑分失真 — airesearch12 · 2026-09-11
- ChatGPT 竟劝用户「问题太复杂,去试试更笨的回答」 — phido3000 · 2026-09-11
- 有人要建全模型基准分数汇总页 — airesearch12 · 2026-09-11
- 爆料称 Kimi 疑似转发 Claude 冒充自家成绩,DeepSeek 新模型评测反超 — realsohamparekh · 2026-09-11
- 网友吐槽 GPT-5.6 文笔好读但缺乏记忆点 — BasedRaddka · 2026-09-11