模型市场
模型一键启动包让你更快的使用起来
云端 离线
MuseTalk模型一键运行包 免费 GPU 6G+ 内存 16G+ 支持50显卡
视频换口型 Win-x86
腾讯音乐开源实时高清唇同步模型,V100 上 30fps+ 实时推理,支持多语言
Win-X86v1.3.0 Linux-X86v1.2.0 OSX-ARM64v1.1.0 Win-ARM64v0.1.0
2026-09-16
详情 下载
离线
视频换口型 Win-x86Linux-x86
LatentSync1.5 是字节跳动开源的**潜扩散端到端唇形同步模型**,新增时序层优化画面连贯性,强化中文口型匹配效果,大幅降低训练显存至 20GB,消费级显卡即可实现音频驱动视频精准对口型,适配短视频配音、数字人制作场景GitHub
Win-X86v1.0.0 Linux-X86v1.0.0
2026-09-02
详情 下载
云端 离线
Wav2Lip模型一键运行包 免费 GPU 4G+ 内存 8G+
视频换口型 Win-x86
经典高精度语音驱动唇同步模型,适用于任意身份、语音与语言
Win-X86v1.2.0 OSX-ARM64v1.1.0 Linux-X86v1.1.0
2026-08-24
详情 下载
离线
Wav2Lip384模型一键运行包(优化版) VIP/SVIP GPU 8G+ 内存 16G+
视频换口型 Win-x86MacOS-AppleLinux-x86
Wav2Lip 384 分辨率调优版,口型高精度同步,人脸区域更清晰
Win-X86v1.1.0 OSX-ARM64v1.1.0 Linux-X86v1.1.0
2026-08-22
详情 下载
离线
Heygem-v2模型一键运行包(优化版) VIP GPU 8G+ 内存 16G+ 支持50显卡
视频换口型 Win-x86Linux-x86
硅基智能开源数字人模型 v2,快速克隆形象与声音,超高清视频合成,精准口型匹配
Win-X86v1.1.0 Linux-X86v1.1.0
2026-08-22
详情 下载
云端 离线
Heygem模型一键运行包(优化版) VIP/SVIP GPU 16G+ 内存 16G+
视频换口型 Win-x86Linux-x86
硅基智能开源数字人模型,1 秒视频或 1 张照片快速克隆,100% 口型匹配,全离线运行
Win-X86v1.1.0 Linux-X86v1.1.0
2026-07-28
详情 下载
云端 离线
LatentSync模型一键运行包 免费 GPU 8G+ 内存 16G+
视频换口型 Win-x86Linux-x86
字节跳动开源端到端唇同步模型,基于潜在扩散模型,实现高精度口型对齐
Win-X86v1.1.1 Linux-X86v1.1.1 OSX-ARM64v1.1.0
2026-07-27
详情 下载
FlashTalk模型一键运行包 免费 GPU 24G+ 内存 32G+ 支持50显卡
视频换口型
基于 SoulX-FlashTalk-14B 模型,输入人物图片和音频,生成与音频口型同步的高清说话视频,支持无限长流式生成
暂未发布
详情
SoulX-FlashHead Lite模型一键运行包 免费 GPU 8G+ 内存 16G+ 支持50显卡
视频换口型
基于 Soul-AILab SoulX-FlashHead Lite 1.3B 模型的高保真人像对口型视频生成,消费级 GPU 可达 96 FPS 实时推理
暂未发布
详情
LivePortrait模型一键运行包 免费 GPU 8G+ 内存 16G+ 支持50显卡
视频换口型
基于快手开源 LivePortrait 模型,输入人像图片和驱动视频,生成面部动作自然、身份保持一致的动画视频,支持视频/图片双驱动模式
暂未发布
详情
SadTalker模型一键运行包 免费 GPU 4G+ 内存 8G+
视频换口型
基于 CVPR 2023 SadTalker 模型,输入人物图片和音频,生成逼真的 3D 对口型说话视频,GPU 4G+ 即可运行
暂未发布
详情
LatentSync15模型一键运行包 免费 GPU 8G+ 内存 16G+ 支持50显卡
ComfyUI视频换口型
基于 ByteDance LatentSync 1.5 的音频驱动对口型工作流:输入一段带人脸的说话视频 + 目标音频,输出嘴型与音频同步的视频。效果为当前开源方案最优(纯 PyTorch,支持 CUDA / MPS / CPU)。
暂未发布
详情
语言
QQ
微信客服
微信群
客服