被忽视的模型能力:什么时候该停下来问你而不是硬猜

sunychoudhary · reddit · 2026-09-08

一位长期跑本地编程模型的用户提出:新模型越来越擅长自主连续执行,但需求含糊时,更好的行为是停下来问「你是要 A 还是 B?」,而不是花 10 分钟推理、做假设、调工具,最后自信地造出错误的东西。

他指出这个行为在 benchmark 中几乎无人测量——大家测编码、推理、工具调用、上下文长度,却不测「模型是否知道信息不足」。他向社区提问:哪些本地模型最擅长在恰当时候提问?这主要取决于模型本身、system prompt 还是 agent harness?

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →