程序员弃用最贵模型实测:单任务成本差近 20 倍

一位程序员在度假期间实测后宣布不再需要「最聪明最贵」的模型,并提出关键指标「每任务成本」(Cost per Task):给定一个表述良好的任务,测模型完成所需的 token 成本。结果显示 GPT-5.6 Luna (max) 单任务成本最高,与便宜模型相差近 20 倍;弃用最强模型后其额度也不再见底。他总结认为,速度而非智能正成为 Agent 工作流的新瓶颈。

2026-09-18 ~ 2026-09-18 · 2 条相关

另有 1 条近重复转述:ievkz