Agent 时代需要 GPU 原生数据库,而不是更多 CPU 集群
智东西 · wechat · 2026-07-24
- 文章的核心判断是:Agent 时代正在把数据库推到“GPU 时刻”。由于 Agent 会反复推理、拆解任务、调用工具和查库,CPU 侧的数据处理、内存带宽和数据搬运开始成为瓶颈。
- 文中强调,这不是单纯“存储容量不够”,而是系统性问题:模型推理在 GPU 上,查询和检索却还在 CPU 上,导致数据在 CPU 内存与 GPU 显存之间来回搬运,GPU 利用率也被拖低。
- 星环科技的解法是把存储、编译、执行引擎都围绕 GPU 重写,并引入 GIDS(GPU-Initiated Direct Storage),让 GPU 直接发起存储访问,绕开 CPU 和主机内存。
- 文章给出的测试结果包括:TPC-DSSF1000 上相对 DuckDB 获得 70 倍加速;OCR/文档入库提速约 10 倍;检索提速约 20 倍;端到端推理提速约 6 倍;复杂企业知识问答场景准确率达到 79.3%。
- 更大的观点是,数据库要从“存数据”进化为 Agent 的“真相所在”,把关系型、向量、图、全文和文档数据统一到一个底座里,同时承担上下文供给和长期记忆管理。
「公司和人」频道最新
- 微软称产品可切到更便宜自研模型,只要效果打平前沿模型 — rohanpaul_ai · 2026-07-24
- 企业 AI Agent 仍像是循环、记忆和工具的拼接 — Johannascot · 2026-07-24
- 腾讯混元合并团队,Alphabet 未来支出承诺达 8110 亿美元 — 快鲤鱼 · 2026-07-24
- 业内论坛:AI 正从生成内容走向构建世界 — 量子位 · 2026-07-24
- Anthropic 说 Claude 现在写了超过 80% 的合并代码 — nathanbenaich · 2026-07-24
- AI 正在压缩协调成本,但公司未必会消失 — prasanna_says · 2026-07-24