aiknow

AI 创作

共 175 个AI 用户与开发者推荐的AI 创作。

全部 AI 创作AI 绘图 59AI 视频 31AI 音乐 16音频处理 5语音合成 / 识别 33数字人 12AI 3D 5AI 设计 14

ComfyUI

github.com

基于节点图的模块化扩散模型创作引擎,支持图像、视频、3D、音频生成,本地推理速度极快。

开源可自部署有 API多模态本地模型Windows
AI 绘图 · 1 处推荐

基于 Gradio 的 Stable Diffusion 网页界面,支持文生图、图生图、局部重绘与插件扩展。

开源可自部署有 API本地模型网页Windows
AI 绘图 · 1 处推荐

Real-ESRGAN

github.com★ 36,978

开源图像/视频超分辨率与修复算法,用合成数据训练,支持动漫与实拍画质增强。

开源可自部署有 API本地模型WindowsLinux
AI 绘图 · 1 处推荐

GFPGAN

github.com★ 37,684

腾讯 ARC 开源的实用人脸修复算法,基于 GAN 先验修复模糊老照片,支持 CPU 与 Windows 运行。

可自部署本地模型网页WindowsLinuxMac
AI 绘图 · 1 处推荐

faster-whisper

github.com★ 25,703

基于 CTranslate2 的 Whisper 语音识别重实现,速度更快、显存占用更低,支持量化与本地部署。

开源可自部署有 API本地模型LinuxWindows
语音合成 / 识别 · 1 处推荐

ElevenLabs

elevenlabs.io

超写实 AI 语音平台,提供语音合成、克隆、配音与语音 Agent,支持 70+ 语言。

免费+付费有 API多模态网页
语音合成 / 识别 · 3 处推荐

SadTalker

github.com★ 14,117

开源AI数字人工具,单张照片加音频即可生成逼真的说话头视频,CVPR 2023论文项目。

可自部署多模态网页LinuxWindows
数字人 · 1 处推荐

Ultimate Vocal Remover GUI

github.com★ 26,478

基于深度神经网络的开源人声分离工具,带图形界面,可提取伴奏与人声。

开源可自部署本地模型桌面客户端Windows
音频处理 · 1 处推荐

开源语音音色转换(变声)框架,10 分钟语音即可训练模型,带网页界面与实时变声。

开源中文界面可自部署本地模型Linux网页
语音合成 / 识别 · 1 处推荐

Fooocus

github.com★ 53,298

基于 SDXL 的开源离线 AI 绘图软件,无需调参,专注提示词即可生成高质量图像。

开源可自部署免登录本地模型WindowsLinux
AI 绘图 · 1 处推荐

Demucs

github.com★ 10,363

Meta 开源的音乐源分离模型,可将歌曲分离为人声、鼓、贝斯等音轨,基于混合 Transformer 架构。

开源可自部署本地模型命令行LinuxMac
音频处理 · 1 处推荐

LiveKit Agents

github.com★ 14,546

开源框架,用于构建可实时听、说、看的多模态语音 AI Agent,支持 WebRTC 与电话接入。

开源有 API多模态可自部署GPTLinux
语音合成 / 识别 · 1 处推荐

InvokeAI

github.com

面向 Stable Diffusion 等模型的本地开源 AI 绘图引擎,提供 WebUI、统一画布与节点式工作流。

开源可自部署本地模型网页WindowsMac
AI 绘图 · 1 处推荐

FunASR

github.com★ 20,580

开源语音识别工具包,支持训练、推理、流式 ASR、VAD、标点与说话人分离,并提供 OpenAI 兼容与 MCP 服务。

开源有 API支持 MCP可自部署本地模型命令行
语音合成 / 识别 · 1 处推荐

MoneyPrinterTurbo

github.com★ 128,429

输入主题或关键词,自动生成脚本、素材、字幕与配乐,一键合成高清短视频的开源工具。

开源可自部署有 API中文界面Kimi网页
AI 视频 · 1 处推荐

Runway

runwayml.com

云端 AI 视频创作平台,提供 Gen-4.5 视频生成模型与图像、音频编辑工具,并有开发者 API。

有 API多模态网页
AI 视频 · 2 处推荐

LivePortrait

github.com

快手开源的高效人像动画模型,可让静态人像、猫狗照片动起来,支持视频驱动与精准编辑。

开源可自部署多模态本地模型WindowsMac
数字人 · 1 处推荐

Murf AI

murf.ai

AI 语音平台,提供超低延迟 TTS API、200+ 拟真音色与对话式语音 Agent,支持 35+ 语言。

有 API网页
语音合成 / 识别 · 2 处推荐

AudioCraft

audiocraft.metademolab.com

Meta 开源的生成式音频代码库,含 MusicGen 文生音乐与 AudioGen 音效生成。

开源可自部署多模态本地模型网页Linux
AI 音乐 · 1 处推荐

WhisperX

github.com

基于 Whisper 的快速语音识别工具,支持词级时间戳与说话人分离,速度可达实时 70 倍。

开源可自部署本地模型LinuxWindows命令行
语音合成 / 识别 · 1 处推荐

ComfyUI-Manager

github.com

ComfyUI 的扩展管理器,可安装、删除、启停自定义节点,并提供节点信息中心。

开源可自部署WindowsLinuxMac
AI 绘图 · 1 处推荐

CosyVoice

github.com

基于大模型的多语言语音生成系统,支持零样本语音克隆、流式合成与指令控制。

开源可自部署通义千问本地模型LinuxWindows
语音合成 / 识别 · 1 处推荐

Midjourney

midjourney.com

知名 AI 绘图工具,以生成高质量、艺术感强的图像著称,同时探索视频模型。

多模态网页
AI 绘图 · 2 处推荐

IOPaint

github.com★ 23,311

免费开源的 AI 图像修复工具,可擦除物体、替换内容并支持扩图,完全本地部署。

开源可自部署本地模型网页WindowsMac
AI 绘图 · 1 处推荐