Real-Time-Voice-Cloning (SV2TTS):经典开源声音克隆项目
Real-Time-Voice-Cloning 是一款基于 SV2TTS 三阶段技术的免费开源声音克隆工具。了解它的工作原理,以及它在今天的位置。
解读开源与热门 AI 语音模型,并了解如何在 Echora 上体验对应能力。
Real-Time-Voice-Cloning 是一款基于 SV2TTS 三阶段技术的免费开源声音克隆工具。了解它的工作原理,以及它在今天的位置。
Speechify 最初是一款面向阅读障碍人群的无障碍文字转语音应用,如今也通过 Studio 提供声音克隆。了解其工作方式、是否免费以及定价。
LOVO AI (Genny) 将文字转语音、1 分钟声音克隆和时间线视频编辑器整合到同一个浏览器工作区,用于制作以旁白为核心的内容。
Voice.ai 可在几秒内克隆声音,并在游戏、Discord 和通话中实时变声,通过设备端运行,在几乎任何应用中实现低延迟。
Respeecher 将真实表演转换为另一种声音,用于电影、电视和游戏,同时保留情绪与节奏。了解其工作原理、价格和应用场景。
WellSaid Labs 通过付费授权,将真实配音演员在知情同意下提供的声音制作成 AI 声音分身,用于企业旁白,而非采用抓取数据或自助声音克隆。
Descript Overdub 可克隆你自己的声音,让你通过打字修正说错的台词。它基于 Lyrebird AI 技术,内置于通过文本进行剪辑的视频与播客编辑器。
Murf AI 将商务语音生成器与仅限企业级方案的声音克隆、PowerPoint 和 Canva 原生集成以及低延迟对话 API 结合在一起。
Play.ht(PlayAI)可以根据短音频样本克隆声音,并以超低延迟流式传输,适用于实时和对话场景。了解价格、注册和 API 步骤。
Resemble AI 可通过短音频样本克隆声音,并为每一条输出添加水印,以追溯来源和检测深度伪造。了解其克隆、安全、定价与 API 配置。
ElevenLabs 是行业标杆级 AI 声音克隆平台,提供 Instant 和 Professional 克隆、TTS、音效与 API。了解功能、价格和设置步骤。
Google Cloud TTS WaveNet 提供通用神经语音、SSML 控制和成熟 API,免费额度用完后每 100 万字符收费 4 美元。