被忽视的模型能力:什么时候该停下来问你而不是硬猜
sunychoudhary · reddit · 2026-09-08
一位长期跑本地编程模型的用户提出:新模型越来越擅长自主连续执行,但需求含糊时,更好的行为是停下来问「你是要 A 还是 B?」,而不是花 10 分钟推理、做假设、调工具,最后自信地造出错误的东西。
他指出这个行为在 benchmark 中几乎无人测量——大家测编码、推理、工具调用、上下文长度,却不测「模型是否知道信息不足」。他向社区提问:哪些本地模型最擅长在恰当时候提问?这主要取决于模型本身、system prompt 还是 agent harness?
「编程与Agent」频道最新
- KubeCon 上海俨然变 AI Con:Agent、Harness、MCP 议题泛滥引吐槽 — lee_stott · 2026-09-08
- 开源 anyCreature:直接用提示词在游戏里生成生物模型 — Forsaken_Media573 · 2026-09-08
- Hermes agent 自己造了个 4.85M 参数 LLM,还用自己的历史训它 — Teknium · 2026-09-08
- Agent 可观测性仍是空白:现有工具只盯着 token 与延迟 — mrtac96 · 2026-09-08
- 让「幽灵」盯着 Codex 干活:开发者用旁观 agent 自动盯梢长任务 — BLUECOW009 · 2026-09-08
- 网友脑洞:Codex 实例互相发现求助,OpenAI 窥探疑云最搞笑解释 — gleech · 2026-09-08