Model Download Funasr模型一键运行包
云端 离线 免费 语音识别 CPU/GPU内存 8G+支持50显卡
支持系统 Win-x86Linux-x86
免费 该资源免费,可直接下载使用

FunASR 是阿里通义实验室(达摩院)开源的工业级语音识别(ASR)工具包,集语音识别、语音活动检测(VAD)、标点恢复、说话人分离、情感识别等多功能于一体,是开源社区最完整的语音识别方案之一。

核心特性

  • 多功能一体化:提供 ASR 识别、VAD 检测、标点恢复、说话人分离(声纹)、情感识别等多种模型与管道
  • 多模型可选:支持 Fun-ASR-Nano(中英日 + 中文方言)、SenseVoice(五语种 + 情感/事件识别)、Paraformer(低延迟流式)等多个主流模型
  • 超高性能:推理速度极快(Fun-ASR-Nano + vLLM 可达 340x 实时),CPU 也能流畅运行
  • 流式识别:支持 WebSocket 流式实时识别,满足实时字幕、会议转写等场景
  • 部署友好:提供 OpenAI 兼容 API 服务、MCP Server、llama.cpp/GGUF 边缘部署方案
  • 训练与微调:开放完整训练代码,支持在自有数据集上训练与微调

适用场景

语音转写、会议纪要、实时字幕、智能客服质检、语音搜索、语音指令控制、情感分析等。

更多信息可参考:https://github.com/modelscope/FunASR

v2.0.1 常规优化 Download
2026-09-05 Win-X86 Linux-X86

✨ 本次更新:

✅ 修复:语音识别完成后不再删除原始输入音频文件(转码后保留用户上传的本地文件,避免被清理队列误删)

v2.0.0 常规优化 Download
2026-09-02 Win-X86 Linux-X86

✅ 基于阿里达摩院 Fun-ASR-Nano 模型的端到端语音识别服务

✅ 支持中文、英文、日文及中文方言/口音的语音转文字

✅ 内置标点与时间戳输出,无需额外标点模型

✅ 支持长音频自动分段识别(内置 VAD 语音活动检测)

✅ 支持热词/上下文提示提升专有名词识别准确率

✅ 支持逆文本归一化(数字、日期自动规整为自然文本)

✅ 默认 GPU 推理,无 GPU 时自动降级 CPU,兼容各类设备


v1.1.0 连续合成优化速度 Download
2025-10-10 Win-X86 OSX-ARM64
v1.0.0 初版发布 Download
2025-08-11 Win-X86 OSX-ARM64
Language
QQ
微信客服
微信群
客服