Dataset
Áudio & Voz
oddadmix/dialectal-arabic-lahgtna-v2
Dataset com 100 mil – 1 milhão de exemplos — 1.7 mil downloads no Hugging Face. Dialectal Arabic Lahgtna v2 Large-scale multi-dialect Arabic speech dataset — 3,000+ hours across 13 Arabic dialects — for training and evaluating…
Hugging Face · Datasets
·oddadmix
·
·↓ 1716
·♥ 18
O dataset oddadmix/dialectal-arabic-lahgtna-v2 está entre os destaques do Hugging Face — dados que alimentam o treinamento e a avaliação dos modelos do momento.
Ficha do dataset
- Tamanho: 100 mil – 1 milhão de exemplos
- Tarefas: reconhecimento de fala
- Idiomas: árabe, inglês
- Downloads: 1.7 mil · Curtidas: 18
Sobre o dataset
Dialectal Arabic Lahgtna v2 Large-scale multi-dialect Arabic speech dataset — 3,000+ hours across 13 Arabic dialects — for training and evaluating dialectal Arabic ASR systems.
Como carregar
Use a biblioteca datasets do Hugging Face:
pip install -U datasets
from datasets import load_dataset
ds = load_dataset("oddadmix/dialectal-arabic-lahgtna-v2")
print(ds)
print(ds["train"][0])Tags
automatic-speech-recognition arabic dialectal-arabic speech asr dialect-identification
// relacionados
Leia também
Modelo
nvidia/NVIDIA-NemotronLabs-VoiceChat-11B
Blog
Detecção de Autoapresentações em Depoimentos Legislativos
Blog
"Muitos São os Meus Nomes": A Anatomia do Assistente e Suas Personas por Meio de Autoencoders Esparsos
Blog