零样本参考声音克隆
上传或录制一段简短参考声音,再使用相同声音身份生成新的语音。
IndexTTS2
使用一段简短参考声音在线生成中文或英文语音,继续使用成熟的 IndexTTS2 链路,并支持情绪控制、Saved Voices、History 和 WAV 下载。
IndexTTS 模型样例
通过官方来源样例对比 IndexTTS2 与最新多语言 IndexTTS 2.5,再选择适合本次生成的模型。
IndexTTS2 继续提供成熟的中英文生成路径。
选择效果示例
IndexTTS2
IndexTTS2 继续是 IndexTTS Online 的一等模型。它通过简短参考声音引导说话人身份与表达,无需单独训练模型。
上传或录制一段简短参考声音,再使用相同声音身份生成新的语音。
当前托管 IndexTTS2 路径支持中文、英文和中英混合文本。
可以跟随参考声音,也可以选择 Happy、Sad、Angry 和 Calm 预设。
Saved Voices、History 和 WAV 下载都不与某一个模型版本永久绑定。
参考声音建议
清晰参考音频更有利于模型聚焦说话人身份。建议使用单人说话、背景噪声少的 WAV 或 MP3;当前产品接受约 3–30 秒参考声音。
模型对比
IndexTTS2 是成熟的中英文生成路径;IndexTTS 2.5 新增五语言明确选择和语速控制。两者都在同一个产品内保留。
IndexTTS 2.5通过可复用参考声音持续生成中文或英文语音。
结合参考声音和情绪预设,用于旁白、对白和创作者内容。
保存常用参考声音,并在同一个账号里找回近期结果。
上传或录制一段清晰、单人说话的短参考音频;登录后也可以选择已保存声音。
输入文本,并选择跟随参考声音或支持的情绪预设。
生成语音、试听效果,需要时重试,然后下载 WAV。
IndexTTS Online 是独立第三方托管服务。上游模型研究、源码和技术细节请以官方项目为准。
可以。引入 IndexTTS 2.5 后,IndexTTS2 仍然是 IndexTTS Online 中可选择的模型。
当前托管 IndexTTS2 路径支持中文和英文,也支持中英混合输入。
不需要。Saved Voices 是共享参考声音资产,不永久绑定 IndexTTS2 或 IndexTTS 2.5。
可以。可以跟随参考声音,也可以使用 Happy、Sad、Angry 和 Calm 预设。
需要日语、西班牙语或阿拉伯语、明确语言选择或语速预设时可以选择 2.5。