Poolside 发布 Laguna S 2.1 118B 并公开完整评测轨迹
_lewtun · x · 2026-07-22
一位研究者称赞 Poolside 把评测全过程轨迹全部公开出来,认为这对理解模型分数是如何得到的非常有帮助,尤其能看清系统提示词是怎样影响 MATH 结果的。
被引用的原帖提到,Laguna S 2.1 是一个新的 118B 参数模型。作者还表示,这种透明披露应当成为常规做法,因为复现其他厂商的评测分数往往要耗费大量时间和 GPU 资源。
「模型」频道最新
- Google高管征集 Gemini 3.6 Flash 等新模型真实反馈 — patloeber · 2026-07-22
- Gemini 3.6 Flash 快两倍便宜 18%,独立测试却没变聪明 — etherd0t · 2026-07-22
- 批评者称 OpenAI 事故被误读为“失控自主” — ambaonadventure · 2026-07-22
- Google 推出 Gemini 3.5 Flash Cyber 网络安全专用模型 — pushmeet · 2026-07-22
- 爆料称 Cerebras 升级后 GPT-5.6 Sol 速度可达 750 tok/s — haider1 · 2026-07-22
- LeCun 转发 Hugging Face:开放权重模型更利于网络防御 — ylecun · 2026-07-22