Dataset Áudio & Voz

oddadmix/dialectal-arabic-lahgtna-v2

Dataset com 100 mil – 1 milhão de exemplos — 1.7 mil downloads no Hugging Face. Dialectal Arabic Lahgtna v2 Large-scale multi-dialect Arabic speech dataset — 3,000+ hours across 13 Arabic dialects — for training and evaluating…

Hugging Face · Datasets ·oddadmix · ·↓ 1716 ·♥ 18

O dataset oddadmix/dialectal-arabic-lahgtna-v2 está entre os destaques do Hugging Face — dados que alimentam o treinamento e a avaliação dos modelos do momento.

Ficha do dataset

  • Tamanho: 100 mil – 1 milhão de exemplos
  • Tarefas: reconhecimento de fala
  • Idiomas: árabe, inglês
  • Downloads: 1.7 mil · Curtidas: 18

Sobre o dataset

Dialectal Arabic Lahgtna v2 Large-scale multi-dialect Arabic speech dataset — 3,000+ hours across 13 Arabic dialects — for training and evaluating dialectal Arabic ASR systems.

Como carregar

Use a biblioteca datasets do Hugging Face:

pip install -U datasets

from datasets import load_dataset

ds = load_dataset("oddadmix/dialectal-arabic-lahgtna-v2")
print(ds)
print(ds["train"][0])

Tags

automatic-speech-recognition arabic dialectal-arabic speech asr dialect-identification

Explorar o dataset no Hugging Face →

compartilhar: