Modelo Áudio & Voz

nyralabs/CrisperWhisper2.0_large

Modelo de reconhecimento de fala — 131 downloads e 51 curtidas no Hugging Face.

Hugging Face · Modelos ·nyralabs · ·↓ 131 ·♥ 51

O modelo nyralabs/CrisperWhisper2.0_large aparece entre os mais comentados do Hugging Face — um termômetro do que a comunidade está realmente usando agora na tarefa de reconhecimento de fala.

Ficha técnica

  • Tarefa: reconhecimento de fala
  • Biblioteca: crisperwhisper
  • Formatos: safetensors
  • Licença: proprietária / outra
  • Downloads: 131 · Curtidas: 51

Como rodar localmente

Transcreva áudio com o pipeline da transformers:

pip install -U transformers torch

from transformers import pipeline

asr = pipeline("automatic-speech-recognition", model="nyralabs/CrisperWhisper2.0_large", device=0)
print(asr("audio.mp3")["text"])

Tags

crisperwhisper safetensors whisper speech-recognition verbatim disfluency ctranslate2 word-timestamps

Abrir o modelo no Hugging Face →

compartilhar: