Modelo
Áudio & Voz
pyannote/speaker-diarization-3.1
Modelo de reconhecimento de fala — 8.2 mi downloads e 2.6 mil curtidas no Hugging Face.
Hugging Face · Modelos
·pyannote
·
·↓ 8230402
·♥ 2584
O modelo pyannote/speaker-diarization-3.1 aparece entre os mais comentados do Hugging Face — um termômetro do que a comunidade está realmente usando agora na tarefa de reconhecimento de fala.
Ficha técnica
- Tarefa: reconhecimento de fala
- Biblioteca:
pyannote-audio - Licença: MIT
- Downloads: 8.2 mi · Curtidas: 2.6 mil
Como rodar localmente
Transcreva áudio com o pipeline da transformers:
pip install -U transformers torch
from transformers import pipeline
asr = pipeline("automatic-speech-recognition", model="pyannote/speaker-diarization-3.1", device=0)
print(asr("audio.mp3")["text"])Tags
pyannote-audio pyannote pyannote-audio-pipeline audio voice speech speaker speaker-diarization
// relacionados
Leia também
Blog
As Reddit stock falls, CEO questions value of Google's AI Overviews
Blog
Smallest.ai raises $13M to build ultra-fast voice AI that sounds genuinely human
Modelo
Audio8/Audio8-TTS-Preview-0.6b
Blog