VideoLingo
github.com
一键全自动视频字幕组:语音识别、字幕切割翻译、对齐与配音,支持多语言。
开源中文界面多模态可自部署GPT本地模型
GitHub ★ 18,691被推荐 1 次
适合做什么
适合做视频搬运、字幕翻译与配音的创作者、本地化团队,需自部署。
标签与属性
同类推荐
基于 CTranslate2 的 Whisper 语音识别重实现,速度更快、显存占用更低,支持量化与本地部署。
开源可自部署有 API本地模型Linux
github.com1 处推荐
语音合成 / 识别开源语音音色转换(变声)框架,10 分钟语音即可训练模型,带网页界面与实时变声。
开源中文界面可自部署本地模型Linux
github.com1 处推荐