QQ扫一扫联系
CosyVoice 2.0-0.5B(优化版) 是阿里通义实验室(FunAudioLLM)开源的流式语音合成模型,基于大语言模型架构,在保留零样本克隆、指令控制等核心能力的同时,针对 长文本合成稳定性 做了深度优化。
长篇文章/小说朗读、有声书制作、课程配音、数字人直播语音、影视解说等长文本生成场景。
更多信息可参考:https://github.com/FunAudioLLM/CosyVoice
✅ 优化:升级推理加速组件,支持新一代 N 卡(50 系列)加速,提升推理性能
✅ 优化:模型缓存统一管理,测试与部署环境一致
✅ 优化:文本前端模型支持离线加载,无网络/无认证环境下推理稳定
✅ 修复:依赖安装失败问题(语音识别依赖与推理组件版本冲突)