Anthropic:95% 分析查询由 Claude 自动完成,瓶颈在结构而非数据
bibryam · x · 2026-09-09
Anthropic 撰文复盘其用 Claude 做自助式数据分析的实践:目前 95% 的业务分析查询已由 Claude 自动完成,整体准确率约 95%。
关键发现:
- 早期尝试中,向系统加入数千条 SQL 示例对分析准确率几乎没有提升;约 80% 的失败案例里,相关查询本来就已经能被检索到。
- 结论是瓶颈不在数据访问或示例数量,而在数据结构与定义(structure, not access):宽表/反范式化会导致指标定义不一致,隔离环境又覆盖不了长尾问题。
文章指出,直接让 agent 对着数仓跑会带来“虚假的精确感”——利益相关者脱离了原本引导他们用正确数据集的文档与专家知识。其方案是把底层基础设施、文档与领域专家的约束内建到 Claude 的工作流中,让非技术员工也能安全地自助提问,替代堆砌 dashboard 和临时取数请求。
「编程与Agent」频道最新
- 设计师把客户简报 discovery 交给 AI agent,每单省回 2 小时 — Tegadesigns · 2026-09-09
- PolyAI 发布 Wren:一个日夜自动改进其他对话 Agent 的编码 Agent — matthen2 · 2026-09-09
- Nex-N2.5 免费登陆 OpenRouter:262K 上下文的视觉反馈环智能体编码模型 — airesearch12 · 2026-09-09
- AI 修 bug 潮涌:simd 一年收 219 个 PR,维护者忙不过来 — lemire · 2026-09-09
- Mastra 发布开源 Agent「Factory」,已代写 30% 的 PR — tristanbob · 2026-09-09
- Ctrlb 开源预处理工具:喂给 LLM 前先剥离噪音 — ruhani_grover · 2026-09-09