Modelo
Áudio & Voz
nyralabs/CrisperWhisper2.0_large
Modelo de reconhecimento de fala — 131 downloads e 51 curtidas no Hugging Face.
Hugging Face · Modelos
·nyralabs
·
·↓ 131
·♥ 51
O modelo nyralabs/CrisperWhisper2.0_large aparece entre os mais comentados do Hugging Face — um termômetro do que a comunidade está realmente usando agora na tarefa de reconhecimento de fala.
Ficha técnica
- Tarefa: reconhecimento de fala
- Biblioteca:
crisperwhisper - Formatos: safetensors
- Licença: proprietária / outra
- Downloads: 131 · Curtidas: 51
Como rodar localmente
Transcreva áudio com o pipeline da transformers:
pip install -U transformers torch
from transformers import pipeline
asr = pipeline("automatic-speech-recognition", model="nyralabs/CrisperWhisper2.0_large", device=0)
print(asr("audio.mp3")["text"])Tags
crisperwhisper safetensors whisper speech-recognition verbatim disfluency ctranslate2 word-timestamps
// relacionados
Leia também
Blog
Evaluation of forced alignment of code-mixed speech: the case of Hindi-English
Blog
MusiChat: Composição por Vibe para Criação Musical
Blog
S2A2: Audio-Visual Imitation Learning for Manipulation Tasks Using Acoustic Spatial Information
Blog