研究发现大模型对自身思考耗时缺乏准确直觉
最新观察发现,大语言模型对自身“思考要花多久”缺乏稳定的直觉与判断力。通过在 ChatGPT 5.6 Pro 中观察 UI 显示的响应时间,用户证实模型在预估耗时上存在明显偏差。同时,Claude Fable 5 Max 在面对相同提示词时,也被证实存在类似的思考时长误判现象。
2026-07-14 ~ 2026-07-14 · 2 条相关
- LLM 对思考时长没直觉 — goodside · 2026-07-14
- Claude Fable 5 Max 也会误判时长 — goodside · 2026-07-14