FunASR
github.com
开源语音识别工具包,支持训练、推理、流式 ASR、VAD、标点与说话人分离,并提供 OpenAI 兼容与 MCP 服务。
开源有 API支持 MCP可自部署国产本地模型
GitHub ★ 20,580被推荐 3 次
适合做什么
适合开发者搭建语音转文字、实时字幕、会议转写与说话人分离服务,也适合中文/多语种 ASR 自部署。
标签与属性
同类推荐
基于 CTranslate2 的 Whisper 语音识别重实现,速度更快、显存占用更低,支持量化与本地部署。
开源可自部署有 API本地模型Linux
github.com1 处推荐
语音合成 / 识别开源语音音色转换(变声)框架,10 分钟语音即可训练模型,带网页界面与实时变声。
开源中文界面可自部署本地模型Linux
github.com1 处推荐