Qwen3.5 手机端耗Token过高,Gemma 4 效率更优
ArtificialAnlys · x · 2026-08-25
评测数据显示,在手机端达到约 60 分的成绩,不同模型的 Token 消耗差异巨大:Qwen3.5 9B (Reasoning) 消耗了 74.5M 输出 tokens 且有 29% 的生成超出 16K 窗口限制;而 Gemma 4 E4B (Reasoning) 仅消耗 5.2M tokens 便达到相似分数且未触顶。手机端 Token 消耗直接转化为时间、能耗和发热,这是比在服务器上更严峻的挑战。
所属事件:Artificial Analysis 发布手机端小模型智能与推理基准(8 条相关)→
「模型」频道最新
- 从 Anthropic 风险报告外推:2026 年底前难现递归自我改进 — peterwildeford · 2026-08-25
- 英伟达 AVO 智能体 ARC-AGI-3 满分,被指基准已过拟合 — DanielKhashabi · 2026-08-25
- 神秘模型 Ox Alpha 登陆 FutureSim,号称比肩国产前沿模型 — maksym_andr · 2026-08-25
- 通义 Qwen3.8-27B 跻身前沿模型行列 — wandb · 2026-08-25
- ComfyUI 节点实现 MiniMax H3 与 Krea2 嫁接 — Key-Philosopher-9327 · 2026-08-25
- 计划自费百美元 benchmark Qwen 量化与 KV 缓存 — m_mukhtar · 2026-08-25