Model Download LatentSync 数字人对口型 ComfyUI工作流一键运行包
免费 ComfyUI视频换口型 GPU 8G+内存 16G+支持50显卡
免费 该资源免费,可直接下载使用

ComfyUILatentSync15 是基于 ByteDance LatentSync 1.5 的音频驱动对口型 ComfyUI 工作流服务。内置完整 ComfyUI 工作流引擎,输入一段带人脸的说话视频与目标音频,即可输出嘴型与音频同步的高质量视频,同时支持在浏览器中直接访问 ComfyUI Web UI 拖拽编辑工作流节点。

核心特性

  • ComfyUI 工作流:内置完整 ComfyUI 引擎,支持 Live 模式(浏览器访问 Web UI 拖拽编辑)与 Watch 模式(平台 API 下发任务自动执行),工作流可自定义扩展
  • LatentSync 1.5 对口型:当前开源效果最优的音频驱动唇同步方案(纯 PyTorch,支持 CUDA / MPS / CPU),基于潜在扩散模型实现高精度口型对齐
  • 低显存友好:默认 256 分辨率推理,8GB 级显卡即可运行;支持 512 高质量模式可选,推理设备自动降级(无 GPU 环境自动切换 CPU/MPS)
  • 完整模型仓库:主模型、Whisper、VAE、人脸检测模型统一由模型仓库管理,初始化自动下载,离线可用
  • 多平台支持:支持 NVIDIA 显卡(CUDA 12.8+,兼容 50 系 Blackwell 架构)与 macOS MPS

适用场景

视频配音口型同步、数字人视频制作、直播数字人实时驱动、影视/短视频二创、多语种视频本地化配音等。

更多信息可参考:https://github.com/bytedance/LatentSync

Language
QQ
微信客服
微信群
客服