DeepSeek+验证器级联策略:成本降63%,准确率超Luna单模型

zainhas · x · 2026-08-07

zainhas提出一种级联策略:先用DeepSeek处理,验证失败时升级到Luna。该策略在DeepSWE任务上达到78.9%的准确率,高于Luna单独使用的67.2%,且成本仅为Luna的63%($0.385 vs $0.61)。第一阶段用10美分的DeepSeek可解决约一半任务,Luna的溢价成本只用于更难的剩余任务。

所属事件:DeepSeek与Luna级联策略兼顾高准确率与低成本(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →