← 在分诊台打开(可搜索/导航)

端侧语音合成(TTS)该用什么——让设备"说话"

🎯 E1 任务→模型路由 · 手机/树莓派/ESP32
状态:Piper是端侧TTS首选,sherpa-onnx统一部署
也这样说: tts 语音合成 文字转语音 piper vits kokoro
可能根因:

解决方案

✅ 官方方案(1条)

Piper TTS 官方仓库
基于ONNX Runtime的轻量TTS,树莓派上实时合成流畅;低质量版速度快音质一般,高质量版自然但更占资源——做语音助手选中等质量版
时效:2026-09
打开 ↗

💡 排坑指南(1条)

sherpa-onnx TTS(统一部署)
sherpa-onnx把TTS纳入统一ONNX部署体系,支持Piper/VITS/Kokoro多引擎;好处是ASR+TTS用同一套框架不用维护两套runtime
时效:2026-09
打开 ↗

⚠️ 避坑提醒(3条)

VITS音质好但端侧跑不动 暂无外链
VITS合成质量比Piper好但模型体积和推理压力更大,树莓派上容易出现"效果好但跑不动";端侧优先Piper,追求质量上服务器跑VITS
时效:2026-09
edge-tts不是端侧方案 暂无外链
edge-tts依赖微软在线服务,断网即不可用;隐私/离线/低延迟场景别选edge-tts,选Piper或sherpa-onnx TTS
时效:2026-09
sherpa-onnx TTS的"框架通了模型跑不了" 暂无外链
用VITS或Kokoro需确认对应ONNX模型+音素/文本预处理+语言包是否完整;常见坑:框架装好了但缺语言包导致中文无法合成
时效:2026-09

本页是路由层入口,不存教程正文。每条入口带人工评注。
来自 问题分诊台 · Vertical Hub