RTX 3060 全本地语音助手复刻 GPT Live 官方演示,6 分钟跑完全程
liampetti · reddit · 2026-09-11
开发者用 12GB 显存的全本地语音助手 Fulloch,对照 OpenAI GPT Live「Improved Intelligence」演示里的同一对话任务(判断航线可行性同时追问目的地美食)进行实测。
配置(全部跑在 RTX 3060 上)
- 语音识别:Qwen3 1.7B ASR
- LLM:Qwen3.5-9B UD-Q4KXL GGUF,12K 上下文
- 语音:Pocket TTS
结果:全程约 6 分半完成(9B 模型思考环节做了加速处理);未能找到合适航线,但美食和餐厅推荐质量不错。作者对 Qwen3.5 9B 在小体量下完成此类任务的表现印象深刻。源码与 Docker 镜像开源于 GitHub(liampetti/fulloch),博客附实测视频与报告。
「模型」频道最新
- BullshitBench 榜单更新:GPT-6-Astra 领先历代 OpenAI 模型仍未及 Anthropic — scaling01 · 2026-09-11
- Agent Astra 在 GauntletBench 得 83%,成首个超人类基线的电脑操作 Agent — ducha_aiki · 2026-09-11
- Kimi K2.8 Preview 上线:性能接近 K3、1M 上下文全档开放 — teortaxesTex · 2026-09-11
- 有人想给软件工程任务建「形态分类」数据库,好按任务选模型 — StewartalsopIII · 2026-09-11
- 用户呼声下 DeepSeek V4 Pro API 宣布继续服务,计费不变 — teortaxesTex · 2026-09-11
- 第三方实测:DeepSeek V4.1 Flash 达 GPT-6 Astra 98% 分,成本仅 1.4% — ayushtweetshere · 2026-09-11