模型市场 CosyVoice-300M-Instruct一键运行包
云端 离线 免费 语音合成语音克隆 GPU 8G+内存 16G+语音指令支持50显卡
支持系统 Win-x86MacOS-Apple
免费 该资源免费,可直接下载使用

CosyVoice-300M-Instruct 是阿里通义实验室(FunAudioLLM)开源的 CosyVoice 系列语音合成模型,在轻量级 300M 参数的基础上加入了 Instruct 指令控制能力,是资源受限场景下的理想选择。

核心特性

  • 指令驱动合成:输入文本 + 自然语言指令(如"用温柔的语气说"),即可生成符合要求的语音
  • 零样本语音克隆:提供参考音频即可复刻说话人音色,无需微调训练
  • 语音合成与克隆一体:既支持普通文本合成,也支持音色克隆与跨语种转换
  • 轻量高效:仅 300M 参数,显存与内存占用低,GPU 8G 即可流畅运行

适用场景

智能客服语音、语音助手、有声内容生产、个性化语音提示音、交互式语音应用等。

更多信息可参考:https://github.com/FunAudioLLM/CosyVoice

啊,事情怎么完成这么多啊,明天又要开会了啊,做不啊,说了你又不听,听又不懂,懂又不做,做又做错,错又不认,认又不改,改又不服,不服又不说,你说叫我怎么办
这次机会让我能够在新的领域中不断学习和成长,同时也激励我去克服自身的不足。
周日被我射熄火了,所以今天是周一。
新的一周开始了,我计划好好利用这段时间来完成手头的工作和项目。
v1.0.0 连续合成优化速度 下载
2025-09-30
v0.5.0 常规优化,支持50卡 下载
2025-07-17

常规优化

支持50卡

v0.4.0 常规优化 下载
2025-06-27
v0.3.0 常规优化 下载
2025-04-10
v0.2.0 常规优化 下载
2025-02-28
v0.1.0 CosyVoice-300M-Instruct 下载
2025-02-24

支持指令如下

[breath] 插入呼吸声音

[breath] 插入呼吸声音

<strong></strong> 强调说明

<laughter></laughter> 笑着说

[noise] 表示噪音或杂音

[laughter] 插入笑声

[cough] 插入咳嗽声

[clucking] 模拟鸡叫声

[accent] 标记或模拟带有某种口音的语音

[quick_breath] 表示快速的呼吸

[hissing] 插入嘶嘶声

[sigh] 插入叹气声

[vocalized-noise] 表示口头上的杂音或模糊的语音

[lipsmack] 插入嘴唇发出的“咂嘴”声音

[mn] 插入“嗯”的声音

声音克隆

模型克隆 请使用5-10s的音频,太长的音频会导致克隆变慢。


语言
QQ
微信客服
微信群
客服