QQ扫一扫联系
FunASR 是阿里通义实验室(达摩院)开源的工业级语音识别(ASR)工具包,集语音识别、语音活动检测(VAD)、标点恢复、说话人分离、情感识别等多功能于一体,是开源社区最完整的语音识别方案之一。
语音转写、会议纪要、实时字幕、智能客服质检、语音搜索、语音指令控制、情感分析等。
更多信息可参考:https://github.com/modelscope/FunASR
✨ 本次更新:
✅ 修复:语音识别完成后不再删除原始输入音频文件(转码后保留用户上传的本地文件,避免被清理队列误删)
✅ 基于阿里达摩院 Fun-ASR-Nano 模型的端到端语音识别服务
✅ 支持中文、英文、日文及中文方言/口音的语音转文字
✅ 内置标点与时间戳输出,无需额外标点模型
✅ 支持长音频自动分段识别(内置 VAD 语音活动检测)
✅ 支持热词/上下文提示提升专有名词识别准确率
✅ 支持逆文本归一化(数字、日期自动规整为自然文本)
✅ 默认 GPU 推理,无 GPU 时自动降级 CPU,兼容各类设备