aiknow
SubForge

SubForge

github.com

Rust 命令行工具,把语音识别、字幕切分、翻译、质量评估与压制/封装串成可复现的 AI 字幕流水线。

开源多模态可自部署GPT本地模型命令行
GitHub ★ 104被推荐 1 次

适合做什么

适合需要批量处理视频字幕的本地化团队、课程翻译者和内容创作者,用命令行自动化完成转写、翻译与压制。

标签与属性

同类推荐

开源模型

Whisper

★ 110,133

OpenAI 开源的通用语音识别模型,支持多语言转写、翻译与语种识别,可本地运行。

开源可自部署本地模型命令行Linux
github.com2 处推荐
本地部署 / 运行

whisper.cpp

★ 54,217

OpenAI Whisper 语音识别模型的 C/C++ 高性能移植版,无依赖、可离线本地运行

开源可自部署本地模型MacWindows
github.com2 处推荐
语音合成 / 识别

faster-whisper

★ 25,703

基于 CTranslate2 的 Whisper 语音识别重实现,速度更快、显存占用更低,支持量化与本地部署。

开源可自部署有 API本地模型Linux
github.com1 处推荐
语音合成 / 识别

超写实 AI 语音平台,提供语音合成、克隆、配音与语音 Agent,支持 70+ 语言。

免费+付费有 API多模态网页
elevenlabs.io3 处推荐
语音合成 / 识别

开源语音音色转换(变声)框架,10 分钟语音即可训练模型,带网页界面与实时变声。

开源中文界面可自部署本地模型Linux
github.com1 处推荐
训练与微调 / 量化

GPT-SoVITS

★ 62,509

开源少样本语音克隆与TTS项目,5秒零样本、1分钟微调即可复刻音色,支持多语言。

开源可自部署本地模型网页Windows
github.com2 处推荐