研究发现Claude可精准诊断开源模型思维链缺陷

开发者近期在对比闭源与开源模型时发现,开源模型(如Qwen和Gemma)在强化学习后容易陷入死循环,且往往隐藏思维过程。然而,如果将这些开源模型的内部思考痕迹提取并提供给Claude Code,Claude能够精准诊断出其中的推理低效之处,甚至帮助优化提示词。

2026-07-30 ~ 2026-07-30 · 2 条相关