模型社区与下载
共 46 个AI 用户与开发者推荐的模型社区与下载。
Gemma 4 31B IT
huggingface.coGoogle 开源的多模态大模型 Gemma 4 31B 指令微调版,支持图文输入,可在 Hugging Face 下载与部署。
pyannote/speaker-diarization-3.1
huggingface.copyannote 开源说话人分离模型,纯 PyTorch 实现,输入音频输出谁在何时说话的标注。
LiblibAI
liblib.art国内影响力领先的AI创作平台,提供10万+模型下载、在线WebUI/ComfyUI绘图与LoRA训练。
StableBeluga2
huggingface.coStability AI 基于 Llama2 70B 微调的开源大语言模型,采用 Orca 风格数据集训练。
gpt-oss-20b
huggingface.coOpenAI 开源的 20B 参数大模型,可在 Hugging Face 下载并本地部署运行。
Kokoro-82M
huggingface.co轻量级开源 TTS 模型,仅 8200 万参数,质量媲美大模型,速度快、成本低,Apache 许可。
SenseVoiceSmall
huggingface.coFunAudioLLM 开源的多语言语音理解模型,支持 ASR、语种识别、情感识别与音频事件检测,推理极快。
VibeVoice-1.5B
huggingface.co微软开源的长篇多说话人语音合成模型,可生成播客级对话音频,最长 90 分钟、最多 4 位说话人。
parakeet-tdt-0.6b-v3
huggingface.co英伟达开源的多语言语音识别模型,6 亿参数,支持 25 种欧洲语言自动识别转写
Unsloth
unsloth.ai开源本地 AI 工作台,可在个人电脑上运行和微调大模型,支持文本、图像、视频与音频。
Parakeet ASR
huggingface.coNVIDIA 开源的高效语音识别模型系列,含 CTC 与 RNN-Transducer 变体,支持流式与多语言。
LTX-2.5
huggingface.coLightricks 开源的视频生成模型,支持文生视频与图生视频,可本地部署并带音频生成。
StableBeluga1-Delta
huggingface.coStability AI 基于 Llama 65B 微调的 Orca 风格开源大模型,需合并 Delta 权重使用。
Jais Family 30B 16K Chat
huggingface.coJais 系列是英阿双语大模型,30B 对话版支持 16K 上下文,阿拉伯语能力突出。
Dia-1.6B
huggingface.coNari Labs 开源的 1.6B 文本转语音模型,可生成带情感、语气和非语言声音的对话语音。
一份在 Rentry 上维护的 Stable Diffusion 模型清单,汇总各类 checkpoint 下载链接与信息。