Glean发布Waldo智能体搜索模型:延迟降50%,Token省25%
verrsane · x · 2026-08-05
Glean 推出了名为 Waldo 的新型智能体搜索模型。该模型专为与 LLM 协同工作而设计,能够在提供前沿智能的同时,将延迟降低约 50%,并将 Token 消耗减少约 25%。
这一更新旨在显著提升企业级 AI 搜索与智能体编排的响应速度和成本效益。
「模型」频道最新
- Qwen官方预告27B新模型,Simon Willison期待端侧表现 — cedric_chee · 2026-08-05
- Mac Mini 跑出 200+ tokens/s:Maple 开源三值权重模型 — garrytan · 2026-08-05
- Reddit 讨论:寻找超越 DavidAU 版的 Qwen 编程微调模型 — Borkato · 2026-08-05
- DeepSeek V4 Flash 疑现身:284B总参数,1M上下文 — MikePFrank · 2026-08-05
- 极限压缩测试:DeepSeek-V4-Flash 暴力量化至 54GB 仍可跑 — giveen · 2026-08-05
- 网友实测 Minimax H3 模型:单行提示词生成绝美代码 — CSProfKGD · 2026-08-05