Dataset Áudio & Voz

google/fleurs

Dataset com 10 mil – 100 mil exemplos — 89.1 mil downloads no Hugging Face. FLEURS Fleurs is the speech version of the FLoRes machine translation benchmark.

Hugging Face · Datasets ·google · ·↓ 89116 ·♥ 438

O dataset google/fleurs está entre os destaques do Hugging Face — dados que alimentam o treinamento e a avaliação dos modelos do momento.

Ficha do dataset

  • Tamanho: 10 mil – 100 mil exemplos
  • Tarefas: reconhecimento de fala
  • Idiomas: afr, amh, ara, asm, ast, azj, …
  • Licença: CC BY 4.0
  • Downloads: 89.1 mil · Curtidas: 438

Sobre o dataset

FLEURS Fleurs is the speech version of the FLoRes machine translation benchmark.

Como carregar

Use a biblioteca datasets do Hugging Face:

pip install -U datasets

from datasets import load_dataset

ds = load_dataset("google/fleurs")
print(ds)
print(ds["train"][0])

Tags

automatic-speech-recognition speech-recognition

Explorar o dataset no Hugging Face →

compartilhar: