用 Jev 当 LLM Judge:低置信度升级到前沿模型省成本

omarsar0 · x · 2026-09-24

Elvis Omar Saravia 分享其正在测试的 agent 评测方案:用 Jev 做 LLM-as-a-Judge,在高置信度场景下直接采信其判定,当置信度低时升级到前沿模型(如 GPT-6 或 Opus 5.5)复核。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →