Qwen3.5 手机端耗Token过高,Gemma 4 效率更优

ArtificialAnlys · x · 2026-08-25

评测数据显示,在手机端达到约 60 分的成绩,不同模型的 Token 消耗差异巨大:Qwen3.5 9B (Reasoning) 消耗了 74.5M 输出 tokens 且有 29% 的生成超出 16K 窗口限制;而 Gemma 4 E4B (Reasoning) 仅消耗 5.2M tokens 便达到相似分数且未触顶。手机端 Token 消耗直接转化为时间、能耗和发热,这是比在服务器上更严峻的挑战。

所属事件:Artificial Analysis 发布手机端小模型智能与推理基准(8 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →