EchoraEchora

AI 模型

解读开源与热门 AI 语音模型,并了解如何在 Echora 上体验对应能力。

7 分钟阅读

Qwen3-TTS:阿里巴巴开源声音克隆模型

Qwen3-TTS(Qwen-TTS)是阿里巴巴的开源 TTS,延迟 97ms,只需 3 秒音频即可克隆声音,还支持文字设计音色,覆盖 10 种语言,可免费试用。

TTS开源 TTS声音克隆音色设计Qwen3-TTS
阅读更多
阅读约 8 分钟

Dia2 TTS:实时流式对话语音模型

Dia2 是 Nari Labs 为 Dia TTS 推出的流式升级版:在接收文本的同时实时生成多说话人对话,并保持各说话人的声音一致。了解它的工作原理。

TTS开源模型流式音频AI 语音Dia2
阅读更多