Model Download SenseVoice 语音识别一键运行包
免费 语音识别 CPU/GPU内存 8G+支持50显卡
免费 该资源免费,可直接下载使用

SenseVoice 是阿里达摩院 FunAudioLLM 开源的多语言语音理解基础模型,支持高精度语音识别(ASR)、情感识别(SER)和音频事件检测(AED),覆盖中文、粤语、英文、日文、韩文五种语言,推理速度极低延迟。

核心特性

  • 多语言语音识别:支持中文、粤语、英文、日文、韩文五种语言,非自回归端到端架构实现低延迟推理
  • 情感识别与事件检测:内置语音情感识别(SER)能力,可检测 bgm、掌声、笑声、哭泣、咳嗽等音频事件
  • 高精度转写:识别结果带标点与时间戳,支持说话人分离(需配合 FunASR 管线)
  • 轻量高效:SenseVoiceSmall 模型体积小,支持 CPU/GPU 双模式推理,无 GPU 自动降级 CPU
  • GGUF 量化支持:支持 llama.cpp/GGUF 格式,可脱离 Python 以单二进制文件在 CPU/边缘设备运行

适用场景

语音转写与字幕生成、语音助手、内容审核、会议记录、多语言音频分析

更多信息可参考:https://www.funasr.com/

Language
QQ
微信客服
微信群
客服