DeepSeek 4.1 Flash 单任务输出 8.8 万 token,思考量远超同级模型

Tight-Grocery9053 · reddit · 2026-09-11

Reddit 用户基于 Artificial Analysis 的图表指出,DeepSeek 4.1 Flash 在同一基准任务中输出了高达 88,574 个 token,而智能指数更高的 GPT-6 Astra low 仅用 4,432 个 token,智能指数 46 对 40。作者强调输出 token 不等于实际产出,但可作为模型「内部思考量」的粗略指标——DeepSeek 为达到相近结果似乎需要多出一个数量级的推理开销。作者也提醒这只是一项基准,benchmark 数字需谨慎解读。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →