voice_01.wav
Translate for me, what is a surprise!
- Referencia
- IndexTeam
- Emoción
- Seguir referencia / neutro
- Compatible con
- IndexTTS2 e IndexTTS 2.5
Comparación de modelos
IndexTTS2 e IndexTTS 2.5 están disponibles en IndexTTS Online, pero encajan en necesidades distintas. Compara los controles que ofrecemos, los idiomas objetivo y ejemplos oficiales de IndexTeam antes de elegir un modelo.
Estas filas describen controles disponibles actualmente en IndexTTS Online. Son capacidades del producto, no puntuaciones subjetivas de calidad.
| Función | IndexTTS2 | IndexTTS 2.5 |
|---|---|---|
| Disponible en IndexTTS Online | Sí | Sí |
| Idiomas objetivo disponibles aquí | Chino, inglés | Chino, inglés, japonés, español, árabe |
| Selector explícito de idioma | No | Sí |
| Preajustes de emoción | Natural, Feliz, Triste, Enfadado, Calmado | Natural, Feliz, Triste, Enfadado, Calmado |
| Control de velocidad disponible | No | Más rápido, Normal, Más lento |
Referencias oficiales
Inglés y chino son útiles para una comparación directa porque ambos modelos alojados los admiten. El audio siguiente procede del corpus oficial de ejemplos de IndexTeam y mantiene una atribución clara al origen.
Translate for me, what is a surprise!
这个呀,就是我们精心制作准备的纪念品,大家可以看到这个色泽和这个材质啊,哎呀多么的光彩照人。
Nota de origen: las grabaciones anteriores son recursos del demo original de IndexTeam. IndexTTS Online aporta el contexto de comparación y las herramientas alojadas, pero no reclama la propiedad de esas grabaciones.
Resultados publicados
El informe técnico original de IndexTTS 2.5 informa de una mejora de 2,28× en el factor de tiempo real manteniendo un WER y una similitud de hablante comparables con IndexTTS2. También describe una cobertura multilingüe más amplia y cambios de arquitectura destinados a reducir el coste de inferencia.
Es un resultado publicado por el proyecto original, no una medición producida por IndexTTS Online. El hardware, el entorno, los textos y la infraestructura de servicio pueden cambiar la latencia observada.
Orientación de producto
Elige IndexTTS2 si tu texto objetivo está en inglés o chino y prefieres la ruta alojada más sencilla con el mismo flujo principal de clonación de voz.
Elige IndexTTS 2.5 si necesitas japonés, español o árabe, un selector explícito de idioma o controles de velocidad además de los preajustes de emoción compartidos.
Si ambos modelos sirven para tu idioma, usa la misma referencia y el mismo texto en Voice Lab y elige el resultado que mejor encaje en tu caso de uso.
Mantener idéntica la referencia permite escuchar mejor diferencias del modelo en vez de diferencias de grabación.
Las mismas palabras y puntuación dan a ambos modelos la misma tarea.
Al comparar emoción o velocidad, evita cambiar varios ajustes al mismo tiempo.
Evalúa pronunciación, similitud del hablante, prosodia, estabilidad y artefactos audibles según tu caso de uso.