Agent 记忆场景实测:DeepSeek V4 Flash 无思考通道又快又稳

Brave_Pressure_9886 · reddit · 2026-08-28

一位做 agent 记忆系统的用户分享:在「约 1000 缓存 prompt token + 2000 token 记忆材料」的抽取/摘要任务上,DeepSeek V4 Flash 0731 的非思考(non-thinking)通道表现意外出色——快且准确,摘要质量优于 Luna 的低/中档运行和 Terra 的低 effort 模式。

其他观察:Qwen 3.5 Flash 是另一个他喜欢的非思考模型,尤其中文表现好;Qwen 3.7/3.8 未测。他自有的编码评分体系里 V4 Flash/Pro 非思考路线得 50 分,Luna low 仅 8 分(私有标准,非公开基准)。他用 ZenMux 作为统一 API 网关切换模型,避免重建集成。核心观点:记忆分析处于重复执行的工作流内部,速度本身就是硬指标,这就是 DeepSeek 留在他轮换列表里的原因。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →