Clonación zero-shot por referencia
Sube o graba una referencia corta y genera nuevo audio con esa identidad de voz.
IndexTTS2
Clona una voz desde una referencia corta y genera audio en inglés o chino con la ruta establecida de IndexTTS2, controles de emoción, voces guardadas, historial y descargas WAV.
Clonación de voz con IndexTTS Online
En líneaAñade una voz de referencia corta y el texto que quieres que diga.
Elige el modelo IndexTTS para esta generación.
Añade entre 3 y 30 segundos de audio claro de una sola persona.
Añade una voz de referencia y texto para empezar.
Salida WAV · Las generaciones con sesión iniciada aparecen en Historial.
Al generar, confirmas que tienes al menos 18 años y que eres titular de la voz de referencia o tienes permiso para usarla. El uso está sujeto a nuestros Términos y Política de uso aceptable.
Muestras de modelos IndexTTS
Compara muestras oficiales de IndexTTS2 y del nuevo IndexTTS 2.5 multilingüe antes de elegir un modelo.
IndexTTS2 sigue disponible para el flujo establecido en inglés y chino.
Elegir muestra
IndexTTS2
IndexTTS2 sigue siendo un modelo de primera clase en IndexTTS Online. Una referencia corta guía la identidad y la interpretación del hablante sin un proceso de entrenamiento separado.
Sube o graba una referencia corta y genera nuevo audio con esa identidad de voz.
La ruta alojada actual de IndexTTS2 admite texto en inglés, chino y mezclas de ambos.
Sigue la referencia o usa los ajustes Happy, Sad, Angry y Calm.
Voces guardadas, historial y WAV no quedan ligados de forma permanente a una versión del modelo.
Consejos para la referencia
Una referencia limpia ayuda al modelo a centrarse en la identidad del hablante. Usa WAV o MP3 con poco ruido de fondo; el producto actual acepta referencias de aproximadamente 3–30 segundos.
Comparación de modelos
IndexTTS2 es la ruta establecida para inglés y chino. IndexTTS 2.5 añade cinco idiomas y control de ritmo. Ambos permanecen disponibles dentro del mismo producto.
IndexTTS 2.5Genera audio repetido en inglés o chino desde una referencia reutilizable.
Combina una referencia y ajustes de emoción para narración, diálogo y contenido de creadores.
Guarda referencias frecuentes y vuelve a resultados recientes desde la misma cuenta.
Sube o graba una muestra corta y clara; con sesión iniciada también puedes elegir una voz guardada.
Escribe el guion y elige Seguir referencia o uno de los ajustes de emoción disponibles.
Genera el audio, escucha el resultado, vuelve a intentarlo cuando sea necesario y descarga el WAV.
IndexTTS Online es un servicio alojado independiente de terceros. El proyecto oficial es la fuente para investigación, código y detalles técnicos del modelo original.
Sí. IndexTTS2 sigue siendo un modelo seleccionable cuando se introduce IndexTTS 2.5.
La ruta alojada actual admite inglés, chino y texto mixto inglés/chino.
No. Las voces guardadas son referencias compartidas entre los modelos.
Sí. Puedes seguir la referencia o usar Happy, Sad, Angry y Calm.
Cuando necesites japonés, español o árabe, selección explícita de idioma o control de ritmo.