QQ扫一扫联系
CosyVoice 2.0 是阿里通义实验室(FunAudioLLM)开源的下一代语音合成模型,基于大语言模型(LLM)与流式生成架构,以 0.5B 参数实现了高质量、高自然度的语音合成,是当前开源社区最流行的 TTS 模型之一。
有声书与播客配音、短视频内容创作、数字人语音、实时语音交互、语音游戏角色配音等。
更多信息可参考:https://funaudiollm.github.io/cosyvoice2/
连续合成优化速度
常规优化
支持50卡
模型更新
AigcPanel v0.5.0+
声音克隆
模型克隆 请使用5-10s的音频,太长的音频会导致克隆变慢。