DeepSeek 4.1 Flash 单任务输出 8.8 万 token,思考量远超同级模型
Tight-Grocery9053 · reddit · 2026-09-11
Reddit 用户基于 Artificial Analysis 的图表指出,DeepSeek 4.1 Flash 在同一基准任务中输出了高达 88,574 个 token,而智能指数更高的 GPT-6 Astra low 仅用 4,432 个 token,智能指数 46 对 40。作者强调输出 token 不等于实际产出,但可作为模型「内部思考量」的粗略指标——DeepSeek 为达到相近结果似乎需要多出一个数量级的推理开销。作者也提醒这只是一项基准,benchmark 数字需谨慎解读。
「模型」频道最新
- 评论:DeepSeek 只发内部研究件不发产品,解释其评测落差 — teortaxesTex · 2026-09-11
- 用户反问 Claude「人类是否真实」,模型回应模拟假说 — vishalmisra · 2026-09-11
- GPT-6 级模型只会死磕目标,用对前提才能榨出价值 — daniel_mac8 · 2026-09-11
- SWE-2 被评速度价格智能综合最强,称当下世界第一模型 — silasalberti · 2026-09-11
- IFM 7B 就能做 AIME 竞赛数学,还自曝 103 条模型作弊轨迹 — rohanpaul_ai · 2026-09-11
- K2 Horizon 用 LoRA 并行解码提速 3 倍,预训练吃下 20T tokens — rohanpaul_ai · 2026-09-11