把 DeepSeek 默认搜索换成 Exa,V4.1 Flash 稳到旗舰级
bookwormengr · x · 2026-09-15
博主分享对 DeepSeek V4.1 Flash 配合自建 harness 的一手实测,三个发现:
- 搜索 API 质量被低估:把默认搜索换成 Exa 后,模型回答质量稳定在 Astra High/Fable 水准。此前约 10% 的回答会变笨,现在一致优秀——作者原以为搜索是无差别商品,实测发现差异巨大。
- Flash 模型潜力:就华为 7.2T NPO Engine 规格与模型争论时,模型坚持立场并自己从多个来源剪贴拼接图表、加红色标注给出一张精确示意图。
- 快而深的调研:V4.1 Flash 跑出 300+ tokens/s,配合 Exa 快速搜索,用 PTC(程序化工具调用)或 Agent Team(子智能体)模式做深度研究,速度远超 ChatGPT/Claude 的 Deep Research(Agent Team 略不稳定)。作者认为 Astra Max 是行业顶尖,但 DS V4.1 Flash + Harness 的性价比最优,『也许 flash 就够了』。
「模型」频道最新
- Claude Fable 5.1 卫冕榜首:百万 token 输入,60 余项规格全解析 — DeepLearningAI · 2026-09-15
- 实测:OpenAI 未调整 Codex 额度,单周期 Astra 用量超 8 亿 token — daniel_mac8 · 2026-09-15
- AlphaSense 实测:Fable 金融研究评分领先,配对分析仅与 Opus-5 打平 — CShorten30 · 2026-09-15
- 爆料:xAI 或今日发布 Grok 4.7,此前多次跳票 — mark_k · 2026-09-15
- 曝 OpenAI 或近期发布 GPT-6 Sol 与 Luna 双版本 — soumitrashukla9 · 2026-09-15
- 普林斯顿研究:推理模型在结构等价任务变体上频现系统性缺失 — princetonu · 2026-09-15