QQ扫一扫联系
你拍了一段视频,但口型没对上,或者想让视频里的人物说出你写的台词——过去这事要么花钱请人做后期,要么忍受开源方案里那些僵硬、出戏的嘴型。
ByteDance 的 LatentSync 1.5 是目前开源社区效果最好的音频驱动对口型方案,嘴部动作自然,和音频的贴合度很高,无论说话还是唱歌都能跟得上。但想用上它,需要自己搞定模型下载、环境搭建、依赖安装、ComfyUI 配置……一套流程下来,非技术用户很容易卡在半路。
AIGCPanel 团队把这套对口型能力封装成了 ComfyUI 工作流 + 一键部署服务,取名 aigcpanel-server-ComfyUILatentSync15。用户要做的只有三件事:下载项目、运行初始化脚本、启动服务。然后打开浏览器,在 ComfyUI 界面上传视频和音频,点运行,就能拿到结果。
整个过程不需要写一行代码。

短视频创作者。 拍了一段口播,某句说错了想重录——不用重拍,替换音频让画面自动对口型就行。嘴型幅度可以调,1.0 自然克制,3.0 夸张吸睛,看你的内容风格。
课程录制。 讲师不方便露脸或者需要补录某段讲解,输入音频直接生成对口型视频,动作自然不浮夸,适合知识类内容。
虚拟主播。 用虚拟形象做直播或录播,音频驱动口型自动同步,支持不同种子随机生成效果,反复试到满意为止。
AI 视频创作。 把对口型作为自己工作流的一个环节,配合文生图、图生视频、语音合成等步骤,搭一条完整的 AI 视频生产线。
因为"能跑"和"用起来顺手"是两回事。
ComfyUI 是一个可视化 AI 工作流引擎,节点拖拽、参数调整、结果预览全在浏览器里完成。LatentSync 被封装成一个自定义节点,像搭积木一样接上视频输入和音频输入,后面再接任意后处理节点——加字幕、调色、合成背景——全部在一个界面里搞定。
如果预制参数不够用,随时可以打开 ComfyUI 原生界面,拖拽新节点、改连线、加处理步骤,保存为自己的版本。下次运行自动用你的版本,默认工作流不受影响。
这对内容创作者来说意味着:不用学编程,也能像搭流水线一样编排 AI 处理流程。
LatentSync 对口型只是 AIGCPanel 模型服务架构的一个例子。同样的设计,可以快速接入文生图、文生视频、语音合成等任意 AI 模型——每个模型都是一份 ComfyUI 工作流,拖拽可用。
AIGCPanel 本身是一个一站式 AI 数字人桌面应用,支持视频合成、声音合成与克隆、25 个以上音视频工具箱、可视化工作流编排、智能直播互动。所有模型以"卡片"形式管理,一键导入、启动、调用。

没有 NVIDIA 显卡也没关系,AIGCPanel 提供云端 AI 模型服务,普通电脑也能跑。
从 LatentSync 1.5 论文发布,到把它变成一条命令就能跑起来的服务,中间隔了不止一个 pip install 的距离。
AIGCPanel 做的事情很直接:把最好的开源模型,封装成最简单易用的产品。无论你是想给自己的视频做对口型,还是想在对口型基础上搭建自己的创作流程,这套方案都能帮你省下大量工程时间。
你最近有想用对口型做什么视频吗?短视频、课程、还是虚拟主播?来评论区聊聊你的想法。