Modelo
Áudio & Voz
fishaudio/s2-pro
Modelo de síntese de voz — 294.7 mil downloads e 1.2 mil curtidas no Hugging Face.
Hugging Face · Modelos
·fishaudio
·
·↓ 294657
·♥ 1167
O modelo fishaudio/s2-pro aparece entre os mais comentados do Hugging Face — um termômetro do que a comunidade está realmente usando agora na tarefa de síntese de voz.
Ficha técnica
- Tarefa: síntese de voz
- Formatos: safetensors
- Licença: proprietária / outra
- Downloads: 294.7 mil · Curtidas: 1.2 mil
Como rodar localmente
Sintetize voz/áudio com a transformers (alguns modelos exigem o código do autor — confira o card):
pip install -U transformers torch
from transformers import pipeline
tts = pipeline("text-to-speech", model="fishaudio/s2-pro", device=0)
out = tts("Olá! Esta é uma voz sintética.")
# out["audio"], out["sampling_rate"]Tags
safetensors fish_qwen3_omni text-to-speech instruction-following multilingual zh en ja
// relacionados
Leia também
Blog
Smallest.ai raises $13M to build ultra-fast voice AI that sounds genuinely human
Modelo
Audio8/Audio8-TTS-Preview-0.6b
Blog
PolyAI Releases Dialog-RSN-1: An Audio-Native Dialog Model That Fuses Turn-Taking, Speech Recognition, Function Calling, And Response
Blog