IndexTTS
github.com
工业级零样本语音克隆 TTS 系统,单段参考音频即可克隆音色,支持多语言与情感、语速、发音精细控制。
开源多模态可自部署国产本地模型Linux
被推荐 2 次
适合做什么
适合需要语音合成、配音、有声内容制作的开发者与团队,可本地部署做多语言情感化 TTS。
标签与属性
同类推荐
基于 CTranslate2 的 Whisper 语音识别重实现,速度更快、显存占用更低,支持量化与本地部署。
开源可自部署有 API本地模型Linux
github.com1 处推荐
语音合成 / 识别开源语音音色转换(变声)框架,10 分钟语音即可训练模型,带网页界面与实时变声。
开源中文界面可自部署本地模型Linux
github.com1 处推荐