告诉agent预算有100万token,它竟多思考3-5倍
paraschopra · x · 2026-09-10
Paras Chopra 做了一项实验:在 prompt 中告诉 agent 本次运行的 token 预算。两个 agent 使用完全相同的底层模型和设置,一个被告知有 1 万 token 预算,另一个 100 万。
结果同一任务下,被告知预算更高的 agent 产生了 3-5 倍长度的推理。这说明模型具备超越单纯任务执行的元认知能力——会根据感知到的资源调整思考深度。他特别强调:这不是独立的 thinking effort 设置,而是完全相同的模型、设置与 prompt,仅因被告知的预算不同而改变了 token 消耗。
所属事件:告知预算百万 token,agent 思考量暴增 3-5 倍(2 条相关)→
「模型」频道最新
- Reddit 用户拆包 safetensors:DeepSeek V4.1 Flash 实为 748B 参数 — DistanceSolar1449 · 2026-09-10
- Kimi K3 上线 RunPod:2.8T 参数、1M 上下文,$3/$15 定价 — Kimi_Moonshot · 2026-09-10
- 一周烧掉3亿 token 仍未触顶,GLM 5.3 额度宽松引热议 — saibharadwaj · 2026-09-10
- 爆料补注:V4 系列或已有 3T 参数模型, Scaling 风险是关键变量 — teortaxesTex · 2026-09-10
- 爆料推算:DeepSeek V4.1 Pro 或为 3.1T 参数 MoE,磁盘占用 2.6TB — teortaxesTex · 2026-09-10
- 新书教程:零基础从零训练微调自己的 GPT 级小模型,附全套 Colab — Roger_M_Taylor · 2026-09-10