Dataset
Áudio & Voz
sarulab-speech/DuplexChat
Dataset em destaque no Hugging Face — 128 downloads. DuplexChat large-scale, two-speaker, full-duplex spoken-dialogue corpus built from public podcast feeds.
Hugging Face · Datasets
·sarulab-speech
·
·↓ 128
·♥ 9
O dataset sarulab-speech/DuplexChat está entre os destaques do Hugging Face — dados que alimentam o treinamento e a avaliação dos modelos do momento.
Ficha do dataset
- Tarefas: audio to audio
- Idiomas: inglês, japonês
- Licença: MIT
- Downloads: 128 · Curtidas: 9
Sobre o dataset
DuplexChat large-scale, two-speaker, full-duplex spoken-dialogue corpus built from public podcast feeds.
Como carregar
Use a biblioteca datasets do Hugging Face:
pip install -U datasets
from datasets import load_dataset
ds = load_dataset("sarulab-speech/DuplexChat")
print(ds)
print(ds["train"][0])Tags
audio-to-audio full-duplex spoken-dialogue speech podcast
// relacionados
Leia também
Blog
Meta ran ads for an app promising to nudify female politicians
Editorial
MiniMax Music 3: uma canção inteira de cinco minutos, com pesos abertos
Blog
Emotion Across Speech and Faces: Shared Affective Mechanisms in Multimodal Foundation Models
Blog