实战微调 0.8B 模型优化本地语音转文字后处理
MoodOdd9657 · reddit · 2026-08-18
作者在开发开源语音应用 SpeakoFlow 时,遇到 ASR 转录后的润色难题:需纠正口误、排版、去口语化但保留正确内容。测试发现 0.8B 小模型配合详细 Prompt 效果显著提升,认为通过微调可胜过大模型。计划使用 Qwen3.5 0.8B 通过 QLoRA 微调,结合真实数据与合成数据(涵盖不变文本与错误修正案例),最终通过 llama.cpp 部署。作者还对比了 Mac 和 Windows 在模型加载速度上的差异,并征求社区关于最佳基座模型和实际痛点的建议。
「编程与Agent」频道最新
- Claude Code 内置 MCP 服务器,支持跨 Agent 工具调用 — jasonkneen · 2026-08-18
- BlackHat 演讲:Slack 安全团队分享 Agent 事件驱动检测实践 — dyn___ · 2026-08-18
- 研究发现多 Agent 协调存在相变,GPT-4o 约 80 人达共识 — bravo_abad · 2026-08-18
- Cora 负责人分享复利工程实战:AI 修复千行代码仅需 15 分钟 — every · 2026-08-18
- 开发者给本地 agent「Sub8」加动画角色,按工作状态实时反应 — Daniel_Farinax · 2026-08-18
- Qwen、GPT、Grok 同台竞技 Three.js 香水站开发 — Acceptable-Object390 · 2026-08-18