Dataset
Áudio & Voz
google/WaxalNLP
Dataset em destaque no Hugging Face — 39.4 mil downloads. Waxal Datasets The WAXAL dataset is a large-scale multilingual speech corpus for African languages, introduced in the paper WAXAL: A Large-Scale Multi…
Hugging Face · Datasets
·google
·
·↓ 39388
·♥ 246
O dataset google/WaxalNLP está entre os destaques do Hugging Face — dados que alimentam o treinamento e a avaliação dos modelos do momento.
Ficha do dataset
- Tarefas: reconhecimento de fala, síntese de voz
- Formato/modalidade: áudio
- Idiomas: ach, aka, amh, bau, dag, dga, …
- Licença: CC BY-SA 4.0
- Downloads: 39.4 mil · Curtidas: 246
Sobre o dataset
Waxal Datasets The WAXAL dataset is a large-scale multilingual speech corpus for African languages, introduced in the paper WAXAL: A Large-Scale Multilingual African Language Speech Corpus.
Como carregar
Use a biblioteca datasets do Hugging Face:
pip install -U datasets
from datasets import load_dataset
ds = load_dataset("google/WaxalNLP")
print(ds)
print(ds["train"][0])Tags
automatic-speech-recognition text-to-speech audio
// relacionados
Leia também
Modelo
nvidia/NVIDIA-NemotronLabs-VoiceChat-11B
Blog
Detecção de Autoapresentações em Depoimentos Legislativos
Blog
"Muitos São os Meus Nomes": A Anatomia do Assistente e Suas Personas por Meio de Autoencoders Esparsos
Blog