模型市场 Funasr一键自动运行包
云端 离线 免费 语音识别 GPU 8G+内存 16G+
支持系统 Win-x86MacOS-Apple
免费 该资源免费,可直接下载使用

FunASR 是阿里通义实验室(达摩院)开源的工业级语音识别(ASR)工具包,集语音识别、语音活动检测(VAD)、标点恢复、说话人分离、情感识别等多功能于一体,是开源社区最完整的语音识别方案之一。

核心特性

  • 多功能一体化:提供 ASR 识别、VAD 检测、标点恢复、说话人分离(声纹)、情感识别等多种模型与管道
  • 多模型可选:支持 Fun-ASR-Nano(中英日 + 中文方言)、SenseVoice(五语种 + 情感/事件识别)、Paraformer(低延迟流式)等多个主流模型
  • 超高性能:推理速度极快(Fun-ASR-Nano + vLLM 可达 340x 实时),CPU 也能流畅运行
  • 流式识别:支持 WebSocket 流式实时识别,满足实时字幕、会议转写等场景
  • 部署友好:提供 OpenAI 兼容 API 服务、MCP Server、llama.cpp/GGUF 边缘部署方案
  • 训练与微调:开放完整训练代码,支持在自有数据集上训练与微调

适用场景

语音转写、会议纪要、实时字幕、智能客服质检、语音搜索、语音指令控制、情感分析等。

更多信息可参考:https://github.com/modelscope/FunASR

v1.1.0 连续合成优化速度 下载
2025-10-10
v1.0.0 初版发布 下载
2025-08-11
语言
QQ
微信客服
微信群
客服