Modelo Áudio & Voz

openai/whisper-large-v3

Modelo de reconhecimento de fala — 4.8 mi downloads e 6.1 mil curtidas no Hugging Face.

Hugging Face · Modelos ·openai · ·↓ 4813358 ·♥ 6132

O modelo openai/whisper-large-v3 aparece entre os mais comentados do Hugging Face — um termômetro do que a comunidade está realmente usando agora na tarefa de reconhecimento de fala.

Ficha técnica

  • Tarefa: reconhecimento de fala
  • Biblioteca: transformers
  • Formatos: safetensors
  • Licença: Apache 2.0
  • Downloads: 4.8 mi · Curtidas: 6.1 mil

Como rodar localmente

Transcreva áudio com o pipeline da transformers:

pip install -U transformers torch

from transformers import pipeline

asr = pipeline("automatic-speech-recognition", model="openai/whisper-large-v3", device=0)
print(asr("audio.mp3")["text"])

Tags

transformers pytorch jax safetensors whisper automatic-speech-recognition audio hf-asr-leaderboard

Abrir o modelo no Hugging Face →

compartilhar: