Modelo Áudio & Voz

pyannote/speaker-diarization-3.1

Modelo de reconhecimento de fala — 8.2 mi downloads e 2.6 mil curtidas no Hugging Face.

Hugging Face · Modelos ·pyannote · ·↓ 8230402 ·♥ 2584

O modelo pyannote/speaker-diarization-3.1 aparece entre os mais comentados do Hugging Face — um termômetro do que a comunidade está realmente usando agora na tarefa de reconhecimento de fala.

Ficha técnica

  • Tarefa: reconhecimento de fala
  • Biblioteca: pyannote-audio
  • Licença: MIT
  • Downloads: 8.2 mi · Curtidas: 2.6 mil

Como rodar localmente

Transcreva áudio com o pipeline da transformers:

pip install -U transformers torch

from transformers import pipeline

asr = pipeline("automatic-speech-recognition", model="pyannote/speaker-diarization-3.1", device=0)
print(asr("audio.mp3")["text"])

Tags

pyannote-audio pyannote pyannote-audio-pipeline audio voice speech speaker speaker-diarization

Abrir o modelo no Hugging Face →

compartilhar: