voice_01.wav
Translate for me, what is a surprise!
- المرجع
- IndexTeam
- الانفعال
- اتباع المرجع / محايد
- يعمل مع
- IndexTTS2 و IndexTTS 2.5
مقارنة النماذج
يتوفر كل من IndexTTS2 و IndexTTS 2.5 على IndexTTS Online، لكن كل واحد يناسب احتياجات مختلفة. قارن أدوات التحكم المتاحة هنا واللغات المستهدفة والأمثلة المرجعية الرسمية من IndexTeam قبل اختيار النموذج.
تصف الصفوف التالية أدوات التحكم المتاحة حاليًا في IndexTTS Online. هذه قدرات للمنتج وليست درجات جودة ذاتية.
| القدرة | IndexTTS2 | IndexTTS 2.5 |
|---|---|---|
| متاح على IndexTTS Online | نعم | نعم |
| اللغات المستهدفة المتاحة هنا | الصينية، الإنجليزية | الصينية، الإنجليزية، اليابانية، الإسبانية، العربية |
| محدد لغة صريح | لا | نعم |
| إعدادات الانفعال | طبيعي، سعيد، حزين، غاضب، هادئ | طبيعي، سعيد، حزين، غاضب، هادئ |
| التحكم بسرعة الكلام | لا | أسرع، عادي، أبطأ |
مراجع رسمية
الإنجليزية والصينية مناسبتان للمقارنة المباشرة لأن النموذجين المستضافين يدعمانهما. الصوت أدناه يأتي من مجموعة الأمثلة الرسمية لـ IndexTeam مع إسناد واضح إلى المصدر الأصلي.
Translate for me, what is a surprise!
这个呀,就是我们精心制作准备的纪念品,大家可以看到这个色泽和这个材质啊,哎呀多么的光彩照人。
ملاحظة المصدر: التسجيلات المرجعية أعلاه أصول من عرض IndexTeam الأصلي. يوفر IndexTTS Online سياق المقارنة والأدوات المستضافة ولا يدعي ملكية هذه التسجيلات.
نتائج منشورة من المصدر
يفيد التقرير التقني الأصلي لـ IndexTTS 2.5 بتحسن قدره 2.28× في عامل الزمن الحقيقي مع الحفاظ على معدل خطأ كلمات وتشابه متحدث قريبين من IndexTTS2. كما يصف تغطية لغوية أوسع وتغييرات معمارية تهدف إلى خفض تكلفة الاستدلال.
هذه نتيجة منشورة من المشروع الأصلي وليست قياسًا من IndexTTS Online. يمكن أن تغير الأجهزة وبيئة التشغيل والنصوص وبنية الخدمة زمن الاستجابة الفعلي.
إرشادات المنتج
اختر IndexTTS2 عندما يكون النص المستهدف بالإنجليزية أو الصينية وتريد مسارًا مستضافًا أبسط مع نفس سير عمل استنساخ الصوت الأساسي.
اختر IndexTTS 2.5 عندما تحتاج إلى اليابانية أو الإسبانية أو العربية، أو إلى محدد لغة صريح أو التحكم بسرعة الكلام إضافة إلى إعدادات الانفعال المشتركة.
إذا كان النموذجان يدعمان لغتك، استخدم الصوت المرجعي والنص نفسيهما في Voice Lab ثم اختر النتيجة الأنسب لاستخدامك.
تثبيت مرجع المتحدث يجعل سماع اختلافات النموذج أسهل بدل اختلافات التسجيل.
الكلمات وعلامات الترقيم نفسها تعطي النموذجين المهمة نفسها.
عند مقارنة الانفعال أو سرعة الكلام، تجنب تغيير عدة إعدادات معًا.
ركز على النطق وتشابه المتحدث والإيقاع والاستقرار والعيوب المسموعة وفقًا لاستخدامك.