Modelo Áudio & Voz

fishaudio/s2-pro

Modelo de síntese de voz — 294.7 mil downloads e 1.2 mil curtidas no Hugging Face.

Hugging Face · Modelos ·fishaudio · ·↓ 294657 ·♥ 1167

O modelo fishaudio/s2-pro aparece entre os mais comentados do Hugging Face — um termômetro do que a comunidade está realmente usando agora na tarefa de síntese de voz.

Ficha técnica

  • Tarefa: síntese de voz
  • Formatos: safetensors
  • Licença: proprietária / outra
  • Downloads: 294.7 mil · Curtidas: 1.2 mil

Como rodar localmente

Sintetize voz/áudio com a transformers (alguns modelos exigem o código do autor — confira o card):

pip install -U transformers torch

from transformers import pipeline

tts = pipeline("text-to-speech", model="fishaudio/s2-pro", device=0)
out = tts("Olá! Esta é uma voz sintética.")
# out["audio"], out["sampling_rate"]

Tags

safetensors fish_qwen3_omni text-to-speech instruction-following multilingual zh en ja

Abrir o modelo no Hugging Face →

compartilhar: