AI 创作
共 175 个AI 用户与开发者推荐的AI 创作。
IndexTTS
github.com工业级零样本语音克隆 TTS 系统,单段参考音频即可克隆音色,支持多语言与情感、语速、发音精细控制。
开源可自部署多模态本地模型Linux网页
语音合成 / 识别 · 1 处推荐
VoiceStudio
github.com开源全本地 ElevenLabs 替代品,支持语音克隆、配音、听写、转录与有声书,覆盖 646 种语言。
开源可自部署多模态中文界面本地模型Mac
语音合成 / 识别 · 1 处推荐
VoiceStudio
github.com开源本地化的 ElevenLabs 替代品,支持声音克隆、配音、听写与有声书,覆盖 646 种语言。
开源可自部署多模态中文界面本地模型Mac
语音合成 / 识别 · 1 处推荐
TTS-WebUI
github.com开源本地语音生成 WebUI,集成 20+ TTS、语音克隆与音乐生成模型,支持扩展安装。
开源可自部署本地模型网页WindowsLinux
语音合成 / 识别 · 1 处推荐
Voice-Pro
github.com开源 Gradio 语音工作台,集成 Whisper 识别、零样本声音克隆、多语言 TTS 与翻译,可处理 YouTube 音频。
开源可自部署多模态中文界面本地模型Windows
语音合成 / 识别 · 1 处推荐
WhisperLiveKit
github.com本地实时语音转文字工具,支持流式识别、说话人分离、翻译,兼容 OpenAI/Deepgram API。
开源有 API可自部署本地模型LinuxMac
语音合成 / 识别 · 1 处推荐
Ideogram
ideogram.ai一站式 AI 图像与视频平台,提供绘图应用、多模型 API 及开源 Ideogram 4.0 模型。
开源有 API支持 MCP多模态网页
AI 绘图 · 1 处推荐
pyVideoTrans
github.com开源视频翻译工具,一站式完成语音识别、字幕翻译、AI 配音与音画同步,支持本地离线与多种在线 API。
开源可自部署中文界面多模态DeepSeekGPT
AI 视频 · 1 处推荐
Krita AI Diffusion
github.comKrita 的 AI 绘图插件,支持局部重绘、扩图、实时绘画与 ControlNet,可本地运行开源模型。
开源可自部署多模态本地模型WindowsMac
AI 绘图 · 1 处推荐
Dreamina
dreamina.capcut.com字节跳动旗下的免费 AI 视频与图像生成平台,支持 Seedance、Seedream 等多种模型。
免费国际版多模态网页
AI 视频 · 1 处推荐