GPT Astra 推理耗时 38 分钟:高 Token 效率不等于低算力成本

___Patrice___ · x · 2026-08-30

针对 GPT Astra 输出 56k tokens 却耗时 38 分钟的现象,作者指出 Token 效率并不等同于算力效率。这暗示模型可能在生成每个 Token 时消耗了更多算力,以换取更好的质量或更少的 Token 总量。这种以算力换质量的策略将直接影响最终定价,引发对其商业化可行性的好奇。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →