EchoraEchora

Modelos de IA

Guias sobre modelos de voz com IA de código aberto e populares, e como testar capacidades comparáveis na Echora.

6 min de leitura

CosyVoice: modelo TTS zero-shot da Alibaba FunAudioLLM

CosyVoice é o TTS open source da Alibaba FunAudioLLM que usa tokens semânticos supervisionados para clonagem de voz zero-shot em 5 idiomas, com apenas 300M de parâmetros.

TTSTTS de código abertoclonagem de vozTTS multilíngueCosyVoice
Ler mais
7 min de leitura

Kokoro TTS: modelo de voz leve de 82M que roda em CPU

Kokoro-82M é um modelo TTS sob licença Apache-2.0, com 54 vozes em 8 idiomas, que roda rápido em CPU sem precisar de GPU. Gratuito, open source e fácil de hospedar por conta própria.

TTScódigo abertoTTS em CPUvoz com IAKokoro-82M
Ler mais
7 min de leitura

Chatterbox Multilingual: clonagem de voz em 23 idiomas

O Chatterbox Multilingual clona uma voz com 5–10 s de áudio e fala em 23 idiomas, mantendo sotaque e timbre consistentes. Código aberto e licença MIT.

TTSTTS multilíngueclonagem de vozvoz entre idiomasChatterbox Multilingual
Ler mais
8 min de leitura

Chatterbox Turbo: TTS ultrarrápido destilado em uma etapa

O Chatterbox Turbo destila a geração TTS de 10 etapas para 1 e reduz a latência para menos de 150 ms em agentes de voz em tempo real. Rápido, de código aberto e com licença MIT.

TTScódigo abertoclonagem de vozvoz com IAChatterbox Turbo
Ler mais
8 min de leitura

Dia2 TTS: modelo de voz com streaming para diálogos em tempo real

O Dia2 é a evolução com streaming do Dia TTS, desenvolvida pela Nari Labs: gera diálogos com múltiplos falantes em tempo real e mantém uma voz consistente para cada um enquanto recebe o texto. Veja como funciona.

TTScódigo abertoáudio em streamingvoz com IADia2
Ler mais