Modelo Áudio & Voz

owensong/Inflect-Nano-v2

Modelo de síntese de voz — 434 downloads e 107 curtidas no Hugging Face.

Hugging Face · Modelos ·owensong · ·↓ 434 ·♥ 107

O modelo owensong/Inflect-Nano-v2 aparece entre os mais comentados do Hugging Face — um termômetro do que a comunidade está realmente usando agora na tarefa de síntese de voz.

Ficha técnica

  • Tarefa: síntese de voz
  • Licença: Apache 2.0
  • Downloads: 434 · Curtidas: 107

Como rodar localmente

Sintetize voz/áudio com a transformers (alguns modelos exigem o código do autor — confira o card):

pip install -U transformers torch

from transformers import pipeline

tts = pipeline("text-to-speech", model="owensong/Inflect-Nano-v2", device=0)
out = tts("Olá! Esta é uma voz sintética.")
# out["audio"], out["sampling_rate"]

Tags

text-to-speech speech-synthesis local-tts cpu edge-ai small-model base-model pytorch

Abrir o modelo no Hugging Face →

compartilhar: