RTX 3060 全本地语音助手复刻 GPT Live 官方演示,6 分钟跑完全程

liampetti · reddit · 2026-09-11

开发者用 12GB 显存的全本地语音助手 Fulloch,对照 OpenAI GPT Live「Improved Intelligence」演示里的同一对话任务(判断航线可行性同时追问目的地美食)进行实测。

配置(全部跑在 RTX 3060 上)

结果:全程约 6 分半完成(9B 模型思考环节做了加速处理);未能找到合适航线,但美食和餐厅推荐质量不错。作者对 Qwen3.5 9B 在小体量下完成此类任务的表现印象深刻。源码与 Docker 镜像开源于 GitHub(liampetti/fulloch),博客附实测视频与报告。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →