AI 视觉模型训练与部署平台,支持视觉模型微调与生产化运行。
适合需要定制视觉模型的开发者与企业,用于视频理解、图像生成等场景。
开源AI数字人工具,单张照片加音频即可生成逼真的说话头视频,CVPR 2023论文项目。
快手开源的高效人像动画模型,可让静态人像、猫狗照片动起来,支持视频驱动与精准编辑。
蚂蚁集团开源的音频驱动半身数字人动画模型,CVPR 2025 收录,可生成说话视频。
AI 视频生成平台,输入文本即可生成带数字人主播、配音和字幕的完整视频,支持 175+ 语言。
开源实时交互流式数字人引擎,支持音视频同步对话、声音克隆与多模型口型驱动
腾讯音乐 Lyra Lab 开源的实时高保真唇形同步模型,可在 V100 上 30fps+ 运行,支持多语言。