EchoraEchora

AI モデル

オープンソースや人気の AI 音声モデルを解説し、Echora で近い機能を試す方法もご紹介します。

読了時間:約7分

Edge TTS:Microsoftのニューラル音声合成を無料で利用

Edge TTSは、Microsoft Edgeの「音声で読み上げる」機能を支えるものと同じオンライン音声を、APIキーやアカウントなしで利用できる無料のオープンソースツールです。

Edge TTSMicrosoft Edgeテキスト読み上げニューラル音声Python TTS
続きを読む
読了目安 7 分

Kyutai Pocket TTS:1億パラメータのCPUリアルタイムモデル

Kyutai Pocket TTSは、1億パラメータ、MITライセンスのモデルです。GPUを必要とせず、CPUだけでリアルタイム音声合成とゼロショット音声クローンを実行します。

Kyutai Pocket TTSCPUテキスト読み上げリアルタイムTTSゼロショット音声クローンCALMMITライセンス
続きを読む
読了時間:7分

KaniTTS:わずか3GBで動く超低VRAMのテキスト読み上げ

KaniTTSは、コンパクトなLFM2言語モデルと効率的なニューラル音声コーデックを組み合わせ、合計わずか3GBのGPU VRAMでリアルタイム音声合成を実行します。

KaniTTSテキスト読み上げ低VRAM TTS音声LLMリアルタイムTTSオープンソース
続きを読む