把推理写进代码注释,可能让模型更会“省脑力”

mertdumenci · x · 2026-07-24

帖子指出一种有意思的失效模式:让模型把推理直接写进输出,可能会帮助它把更多“思考预算”用在可见输出上,而这部分未必会被 RL 奖励函数完整捕捉到。

它还提到,Claude 常在代码注释里“叙述会话”的习惯,可能和这种模式是同一类问题:把内部推理泄露进代码输出,而不是与代码本身分离。

所属事件:Claude爱在代码注释碎碎念,被指存在推理机制缺陷(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →