Modelo
Áudio & Voz
OpenMOSS-Team/MOSS-SoundEffect-v2.0
Modelo de geração de áudio — 821 downloads e 102 curtidas no Hugging Face.
Hugging Face · Modelos
·OpenMOSS-Team
·
·↓ 821
·♥ 102
O modelo OpenMOSS-Team/MOSS-SoundEffect-v2.0 aparece entre os mais comentados do Hugging Face — um termômetro do que a comunidade está realmente usando agora na tarefa de geração de áudio.
Ficha técnica
- Tarefa: geração de áudio
- Biblioteca:
diffusers - Formatos: safetensors
- Licença: Apache 2.0
- Downloads: 821 · Curtidas: 102
Como rodar localmente
Use a biblioteca diffusers para gerar imagens:
pip install -U diffusers transformers accelerate torch
from diffusers import DiffusionPipeline
import torch
pipe = DiffusionPipeline.from_pretrained(
"OpenMOSS-Team/MOSS-SoundEffect-v2.0", torch_dtype=torch.float16
).to("cuda")
image = pipe("um gato astronauta, cinematográfico").images[0]
image.save("saida.png")Tags
diffusers safetensors text-to-audio diffusion flow-matching sound-effects audio-generation en
// relacionados
Leia também
Editorial
Qwen-Music: para gerar uma canção com voz, o modelo primeiro compõe a melodia
Blog
Controlling Implicit Shortcut Reliance in L2 Spoken English Auto-markers
Blog
AnovaX: A Local, Multi-Agent Voice Assistant with LLM Planning, Typed Executors, and Adaptive Recovery
Blog