模型市场 Qwen3TTS模型一键运行包
离线 免费 语音合成语音克隆 GPU 8G+内存 16G+
支持系统 Win-x86MacOS-AppleLinux-x86
免费 该资源免费,可直接下载使用

Qwen3-TTS 是阿里云通义千问(Qwen)团队于 2026 年初开源的语音合成模型系列,基于自研 Qwen3-TTS-Tokenizer-12Hz,支持稳定的、富有表现力的流式语音生成,以及自由语音设计与生动的语音克隆,是功能最全面的开源 TTS 之一。

核心特性

  • 十语种全覆盖:支持中文、英文、日文、韩文、德文、法文、俄文、葡萄牙文、西班牙文、意大利文及多方言语音
  • 语音克隆:仅需约 3 秒参考音频即可高质量复刻音色(Base 系列模型)
  • 语音设计:通过自然语言描述直接"设计"全新音色(VoiceDesign 模型),无需参考音频
  • 自然语言语音控制:可用指令控制音色、情感、韵律等多维声学属性,实现"所见即所听"
  • 极低延迟流式生成:双轨混合流式架构,单字符输入即可输出首个音频包,端到端合成延迟低至约 97ms
  • 多种规格:提供 0.6B / 1.7B 参数,支持 vLLM 高性能推理

适用场景

实时语音交互、智能客服、有声内容生产、数字人语音、多语言内容出海、角色配音等。

更多信息可参考:https://github.com/QwenLM/Qwen3-TTS

v1.0.0 初版发布 下载
2026-04-27
语言
QQ
微信客服
微信群
客服