Vitalik 实测 Qwen 3.8 flash:笔记本本地跑分亮眼,本地模型拐点将至
anselm · x · 2026-09-17
Vitalik Buterin 转发并点评了一份 llama.cpp 在笔记本(Strix Halo)上跑 Qwen 3.8 flash 的测试,称其表现确实令人印象深刻,且 llama.cpp 对该模型的支持正快速变好。测试表格对比了新旧 prompt 的输入/输出 token 速度。
他的判断是:本地模型很快就能承担大部分日常任务;对于更复杂的需求,「用本地模型编排对强大云端模型的查询,避免个人隐私信息外泄」这类工作流将变得真正可行。
「Infra」频道最新
- Walmart 免训练三指标路由器:解决 RAG 压缩悖论,T4 上 0% OOM — _reachsumit · 2026-09-17
- Nebius 10月起上调 GPU 按需价格,H100 涨17%、B300 涨21% — sudoraohacker · 2026-09-17
- Pinterest 分享十亿级向量检索模型演进经验,含多条工程教训 — AxSaucedo · 2026-09-17
- 机器人训练掀起「第一视角数据热」,Maxinsights 已交付 200 万小时 — 机器之心 · 2026-09-17
- 华邦 11.2 亿美元收购英飞凌 NOR Flash 业务,将成全球第一 — zephyr_z9 · 2026-09-17
- IonQ 携手橡树岭国家实验室,用生成式 AI 优化量子计算 — donutloop · 2026-09-17