实测重试策略:补错误反馈让本地模型解题率从 42% 升到 75%

BlubberingSense · reddit · 2026-09-02

作者用 Advent of Code 2024/2025 的题目作为有客观正确答案的测试集,固定使用 qwen3.8:27b 本地模型,逐项变量测重试策略的回报。

核心数据

关键结论

给构建重试循环的人的规则:加干预前先问「模型因此学到了什么它原本不知道的东西」,答案是「没有」就别加。样本量小(4 题×3 次),但在未测过的 AoC 2025 上复验了模式。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →