Modelo
Áudio & Voz
openai/whisper-large-v3
Modelo de reconhecimento de fala — 4.8 mi downloads e 6.1 mil curtidas no Hugging Face.
Hugging Face · Modelos
·openai
·
·↓ 4813358
·♥ 6132
O modelo openai/whisper-large-v3 aparece entre os mais comentados do Hugging Face — um termômetro do que a comunidade está realmente usando agora na tarefa de reconhecimento de fala.
Ficha técnica
- Tarefa: reconhecimento de fala
- Biblioteca:
transformers - Formatos: safetensors
- Licença: Apache 2.0
- Downloads: 4.8 mi · Curtidas: 6.1 mil
Como rodar localmente
Transcreva áudio com o pipeline da transformers:
pip install -U transformers torch
from transformers import pipeline
asr = pipeline("automatic-speech-recognition", model="openai/whisper-large-v3", device=0)
print(asr("audio.mp3")["text"])Tags
transformers pytorch jax safetensors whisper automatic-speech-recognition audio hf-asr-leaderboard
// relacionados
Leia também
Modelo
nvidia/NVIDIA-NemotronLabs-VoiceChat-11B
Blog
Detecção de Autoapresentações em Depoimentos Legislativos
Blog
"Muitos São os Meus Nomes": A Anatomia do Assistente e Suas Personas por Meio de Autoencoders Esparsos
Blog