Vitalik 实测 Qwen 3.8 flash:笔记本本地跑分亮眼,本地模型拐点将至

anselm · x · 2026-09-17

Vitalik Buterin 转发并点评了一份 llama.cpp 在笔记本(Strix Halo)上跑 Qwen 3.8 flash 的测试,称其表现确实令人印象深刻,且 llama.cpp 对该模型的支持正快速变好。测试表格对比了新旧 prompt 的输入/输出 token 速度。

他的判断是:本地模型很快就能承担大部分日常任务;对于更复杂的需求,「用本地模型编排对强大云端模型的查询,避免个人隐私信息外泄」这类工作流将变得真正可行。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →