iPad 本地跑模型达 164 tokens/秒,新本地 AI 应用引期待
TheOyinbooke · x · 2026-09-26
开发者 TheOyinbooke 展示了一款尚未发布的本地 AI 应用,在 iPad 上实现 164 tokens/秒的生成速度,并表示后续会带来更多测试,邀请用户报名参与测试。端侧推理速度达到该水平意味着本地大模型在移动设备上的可用性显著提升,但应用具体实现细节(模型、量化方案、芯片)尚未公布。
「Infra」频道最新
- Prime Intellect 盘点 AGI 技术栈七大品类:RLaaS、数据评测、推理、沙盒等 — willcb · 2026-09-26
- Fireworks 联手 HUD 推 RL 训练 Cookbook,一次定义任务即可训练+评估 — sophiamyang · 2026-09-26
- 阿姆斯特丹首届 Tokenomicon 纪实:开发者聊 LLM token 经济学 — Bartaseth · 2026-09-26
- 首届 Tokenomicon 大会在阿姆斯特丹举行,聚焦 LLM Token 经济学 — Bartaseth · 2026-09-26
- SemiAnalysis 图表:中国 1 美元达成美国 5 美元 AI 数据中心效果 — harris_edouard · 2026-09-26
- UBS 预测美光 FQ4 营收近 520 亿美元,AI 内存缺口将持续到 2027 — tengyanAI · 2026-09-26