Downloads · 30 days
3
5% of all-time downloads
Dallyana/espnet_asr_model2
espnet_asr_model2 is a automatic speech recognition model from Dallyana. Use it when you need speech turned into text. It is set up for espnet. The card lists the license as apache-2.0.
reazonspeech-espnet-v1 es un modelo de reconocimiento automático del habla (ASR) entrenado con espnet2 para el español ecuatoriano. Este modelo tiene como objetivo reconocer el habla de diferentes regiones y acentos d…
Downloads · 30 days
3
5% of all-time downloads
All-time downloads
62
Public
Repo size
136 MB
Likes
0
Public
Click a slice to open those files.
.pth136 MB · 100%
From the Hugging Face model README
reazonspeech-espnet-v1 es un modelo de reconocimiento automático del habla (ASR) entrenado con espnet2 para el español ecuatoriano. Este modelo tiene como objetivo reconocer el habla de diferentes regiones y acentos del Ecuador, usando un corpus propio y el corpus de Common Voice. El modelo usa una arquitectura de transformador con codificación por subpalabras (BPE). El modelo alcanza un WER de X% y un MOS de Y en el conjunto de datos de prueba. Para más detalles sobre el modelo, puedes consultar este artículo.