ElevenLabs local en tu propio hardware con VoiceStudio
VoiceStudio ofrece síntesis de voz, clonación y transcripción con calidad de ElevenLabs en local—no hay nube, no hay suscripciones, solo poder open source.
Idioma
InicioLenguajes
Secciones
VoiceStudio ofrece síntesis de voz, clonación y transcripción con calidad de ElevenLabs en local—no hay nube, no hay suscripciones, solo poder open source.
SGLang-Omni es un runtime especializado para inferencia de modelos de voz y multimodales, gestionando el pipeline desde codificación de audio hasta síntesis.
Pixelle-Video es un motor para automatizar la creación de vídeos cortos a partir de una única indicación de texto. Genera MP4 con locución, subtítulos, música y visuales generados por IA.
Alexandria transforma cualquier texto en una producción de audio multivoz utilizando análisis con LLM y síntesis de voz neuronal. Aquí te explicamos cómo funciona y si vale la pena probarlo.
UnrealGenAISupport es un plugin de código abierto que conecta Unreal Engine con LLMs modernos como OpenAI, Claude, DeepSeek y Gemini, con soporte MCP para control del editor.
IndexTTS2 es un modelo de síntesis de voz de código abierto de nueva generación con control preciso de duración y separación de emociones para generación de voces realistas.
GPT-SoVITS es una solución de código abierto para clonar voces que puede sintetizar habla con solo 5 segundos de audio. Conoce sus características y aplicaciones prácticas.