SenseVoiceSmall:基于 FunASR 生态的多语言音频理解项目

可用于高精度语音识别、情感辨识和音频事件检测,支持50+语言,输出富文本转写结果。采用非自回归框架,推理延迟低,10s音频仅需70ms,支持微调与多客户端部署。【此简介由AI生成】

分支2Tags0

项目介绍

可用于高精度语音识别、情感辨识和音频事件检测,支持50+语言,输出富文本转写结果。采用非自回归框架,推理延迟低,10s音频仅需70ms,支持微调与多客户端部署。【此简介由AI生成】

定制我的领域