SenseVoice:高精度多语言语音识别与音频理解,支持情感辨识和事件检测,推理高效

支持50+语言语音识别,优于Whisper模型,具备情感识别、音频事件检测能力。非自回归架构推理延迟极低,10s音频仅需70ms,支持微调与多端部署。【此简介由AI生成】

分支24Tags5

项目介绍

支持50+语言语音识别,优于Whisper模型,具备情感识别、音频事件检测能力。非自回归架构推理延迟极低,10s音频仅需70ms,支持微调与多端部署。【此简介由AI生成】

定制我的领域