Modelo
Áudio & Voz
owensong/Inflect-Nano-v2
Modelo de síntese de voz — 802 downloads e 121 curtidas no Hugging Face.
Hugging Face · Modelos
·owensong
·
·↓ 802
·♥ 121
O modelo owensong/Inflect-Nano-v2 aparece entre os mais comentados do Hugging Face — um termômetro do que a comunidade está realmente usando agora na tarefa de síntese de voz.
Ficha técnica
- Tarefa: síntese de voz
- Licença: Apache 2.0
- Downloads: 802 · Curtidas: 121
Como rodar localmente
Sintetize voz/áudio com a transformers (alguns modelos exigem o código do autor — confira o card):
pip install -U transformers torch
from transformers import pipeline
tts = pipeline("text-to-speech", model="owensong/Inflect-Nano-v2", device=0)
out = tts("Olá! Esta é uma voz sintética.")
# out["audio"], out["sampling_rate"]Tags
text-to-speech speech-synthesis local-tts cpu edge-ai small-model base-model pytorch
// relacionados
Leia também
Modelo
nvidia/NVIDIA-NemotronLabs-VoiceChat-11B
Blog
Detecção de Autoapresentações em Depoimentos Legislativos
Blog
"Muitos São os Meus Nomes": A Anatomia do Assistente e Suas Personas por Meio de Autoencoders Esparsos
Blog