EchoraEchora

AI 模型

解读开源与热门 AI 语音模型,并了解如何在 Echora 上体验对应能力。

7 分钟阅读

SeamlessM4T:Meta 一体化语音翻译模型

SeamlessM4T 是 Meta 推出的开源模型,将语音识别、翻译和语音合成统一到一个系统中,覆盖多达 100 种语言。

语音翻译多语言语音语音到语音翻译自动语音识别SeamlessM4T
阅读更多
7 分钟阅读

NeuTTS Air:轻量级端侧声音克隆模型

NeuTTS Air 是 Neuphonic 推出的端侧 TTS 模型,参数不足 10 亿,只需 3 秒音频即可克隆声音,并可在手机和树莓派上运行。

NeuTTS Air端侧 TTS声音克隆轻量级 TTSGGUF树莓派Neuphonic
阅读更多
7 分钟阅读

Kyutai Pocket TTS:100M 参数 CPU 实时模型

Kyutai Pocket TTS 是一款 100M 参数、采用 MIT 许可证的模型,仅凭 CPU 即可进行实时语音合成和零样本声音克隆,无需 GPU。

Kyutai Pocket TTSCPU 文字转语音实时 TTS零样本声音克隆CALMMIT 许可证
阅读更多