QQ扫一扫联系
CosyVoice-300M-Instruct 是阿里通义实验室(FunAudioLLM)开源的 CosyVoice 系列语音合成模型,在轻量级 300M 参数的基础上加入了 Instruct 指令控制能力,是资源受限场景下的理想选择。
智能客服语音、语音助手、有声内容生产、个性化语音提示音、交互式语音应用等。
更多信息可参考:https://github.com/FunAudioLLM/CosyVoice
常规优化
支持50卡
支持指令如下
[breath] 插入呼吸声音
[breath] 插入呼吸声音
<strong></strong> 强调说明
<laughter></laughter> 笑着说
[noise] 表示噪音或杂音
[laughter] 插入笑声
[cough] 插入咳嗽声
[clucking] 模拟鸡叫声
[accent] 标记或模拟带有某种口音的语音
[quick_breath] 表示快速的呼吸
[hissing] 插入嘶嘶声
[sigh] 插入叹气声
[vocalized-noise] 表示口头上的杂音或模糊的语音
[lipsmack] 插入嘴唇发出的“咂嘴”声音
[mn] 插入“嗯”的声音
声音克隆
模型克隆 请使用5-10s的音频,太长的音频会导致克隆变慢。