大模型
共 135 个AI 用户与开发者推荐的大模型。
Wan2.2-T2V-A14B
huggingface.co阿里通义万相开源视频生成模型,MoE架构,支持文生视频,720P@24fps,画质电影级。
pyannote/speaker-diarization-3.1
huggingface.copyannote 开源说话人分离模型,纯 PyTorch 实现,输入音频输出谁在何时说话的标注。
Qwen-Image-2.1
huggingface.co通义千问开源的多模态图像生成与编辑模型,7B 参数,支持文生图、透明图层与局部编辑。
OpenCompass 司南
opencompass.org.cn开源、全面的大模型评测开放平台,提供 LLM 与多模态榜单、评测集社区和竞技场。
StableBeluga2
huggingface.coStability AI 基于 Llama2 70B 微调的开源大语言模型,采用 Orca 风格数据集训练。
Qwen3.8-Flash-Next
huggingface.co阿里通义千问开源的多模态大模型,支持图文理解,可在 Hugging Face 下载部署。
gpt-oss-20b
huggingface.coOpenAI 开源的 20B 参数大模型,可在 Hugging Face 下载并本地部署运行。
MusicLM
google-research.github.ioGoogle Research 的文本生成音乐模型,可按文字描述生成高保真音乐,并支持哼唱旋律转风格。
DeepSeek-V4.1-Flash
huggingface.coDeepSeek 在 Hugging Face 上发布的多模态开源大模型,支持图文输入与本地部署。
Janus-Pro-7B
huggingface.coDeepSeek 开源的多模态理解与生成统一模型,解耦视觉编码,7B 参数。
Kokoro-82M
huggingface.co轻量级开源 TTS 模型,仅 8200 万参数,质量媲美大模型,速度快、成本低,Apache 许可。
Qwen-Image-Edit
huggingface.co通义千问开源图像编辑模型,支持中英文字精准编辑与语义/外观修改,性能达 SOTA。
SenseVoiceSmall
huggingface.coFunAudioLLM 开源的多语言语音理解模型,支持 ASR、语种识别、情感识别与音频事件检测,推理极快。
Hunyuan-MT-7B
huggingface.co腾讯开源的 7B 翻译大模型,支持 33 种语言互译,WMT25 比赛 31 项中 30 项第一。
GLM-5.3
huggingface.co智谱开源大模型 GLM-5.3,基于 GLM-5.2 后训练强化,复杂编程能力显著提升。
Stable Audio 3.0
stability.aiStability AI 推出的生成式音频模型家族,基于全授权数据训练,部分模型开放权重可下载。