EchoraEchora

AI モデル

オープンソースや人気の AI 音声モデルを解説し、Echora で近い機能を試す方法もご紹介します。

6分で読めます

CosyVoice:Alibaba FunAudioLLM のゼロショット TTS モデル

CosyVoice は、教師ありセマンティックトークンを用い、わずか 3 億パラメータで 5 言語にわたるゼロショット音声クローンを実現する、Alibaba FunAudioLLM のオープンソース TTS です。

TTSオープンソース TTS音声クローン多言語 TTSCosyVoice
続きを読む
7分で読めます

Kokoro TTS:CPUで動く82Mの軽量音声モデル

Kokoro-82Mは、8言語・54種類の音声を備え、GPUなしでCPU上でも高速に動作するApache-2.0ライセンスのTTSモデルです。無料、オープンソースで、セルフホストも容易です。

TTSオープンソースCPU TTSAI音声Kokoro-82M
続きを読む
読了時間: 約7分

Chatterbox Multilingual:23言語対応の音声クローン

Chatterbox Multilingual は5〜10秒の音声から声をクローンし、アクセントと声色を保ったまま23言語で発話します。オープンソースで MIT ライセンスです。

TTS多言語 TTS音声クローン言語横断音声Chatterbox Multilingual
続きを読む
読了時間: 約8分

Chatterbox Turbo:1ステップ蒸留による超高速 TTS

Chatterbox Turbo は TTS 生成を10ステップから1ステップへ蒸留し、リアルタイム音声エージェントのレイテンシを150ミリ秒未満に短縮します。高速、オープンソース、MIT ライセンスです。

TTSオープンソース音声クローンAI音声Chatterbox Turbo
続きを読む