Modelo
Áudio & Voz
IndexTeam/IndexTTS-2.5
Modelo de síntese de voz — 5.4 mil downloads e 144 curtidas no Hugging Face.
Hugging Face · Modelos
·IndexTeam
·
·↓ 5361
·♥ 144
O modelo IndexTeam/IndexTTS-2.5 aparece entre os mais comentados do Hugging Face — um termômetro do que a comunidade está realmente usando agora na tarefa de síntese de voz.
Ficha técnica
- Tarefa: síntese de voz
- Biblioteca:
indextts - Formatos: safetensors
- Licença: proprietária / outra
- Downloads: 5.4 mil · Curtidas: 144
Como rodar localmente
Sintetize voz/áudio com a transformers (alguns modelos exigem o código do autor — confira o card):
pip install -U transformers torch
from transformers import pipeline
tts = pipeline("text-to-speech", model="IndexTeam/IndexTTS-2.5", device=0)
out = tts("Olá! Esta é uma voz sintética.")
# out["audio"], out["sampling_rate"]Tags
indextts safetensors text-to-speech tts zero-shot voice-cloning multilingual cross-lingual
// relacionados
Leia também
Blog
Meta ran ads for an app promising to nudify female politicians
Editorial
MiniMax Music 3: uma canção inteira de cinco minutos, com pesos abertos
Blog
Emotion Across Speech and Faces: Shared Affective Mechanisms in Multimodal Foundation Models
Blog