zgba 站群
中文工具 · 首页 ← English

AI 语音与配音工具:20 个开源声音项目

AI 语音合成与识别工具,做配音、声音克隆、语音转文字。收录 F5-TTS、ChatTTS、bark、Whisper 等 20 个开源项目,免费本地运行。

AI 语音

Whisper 语音识别

⭐ 107k+ GitHub Stars

OpenAI 开源语音识别模型

GPT-SoVITS 声音克隆

⭐ 61k+ GitHub Stars

强大的少样本声音克隆与 TTS 工具

Whisper.cpp 高效识别

⭐ 53k+ GitHub Stars

OpenAI Whisper 的 C/C++ 高速本地推理实现

Coqui 深度学习 TTS

⭐ 46k+ GitHub Stars

深度学习文本转语音工具集

ChatTTS 对话语音

⭐ 40k+ GitHub Stars

细粒度对话场景文本转语音模型

Bark 语音生成

⭐ 39k+ GitHub Stars

支持情感和音乐的文本转语音生成模型

RVC 声线转换

⭐ 38k+ GitHub Stars

基于检索的实时声线转换 Web 界面

OpenVoice 声音克隆

⭐ 37k+ GitHub Stars

MyShell 出品的即时声音克隆工具

Fish Speech TTS

⭐ 32k+ GitHub Stars

支持声音克隆的新一代 TTS 解决方案

so-vits-svc 歌声转换

⭐ 28k+ GitHub Stars

基于 VITS 和 SoftVC 的歌声转换模型

Faster Whisper 加速识别

⭐ 25k+ GitHub Stars

基于 CTranslate2 的 4 倍加速 Whisper 实现

WhisperX 带对齐识别

⭐ 24k+ GitHub Stars

带词级时间戳和说话人分离的 Whisper

AudioCraft 音频生成

⭐ 24k+ GitHub Stars

Meta 开源的音频与音乐生成库

FunASR 语音识别框架

⭐ 20k+ GitHub Stars

阿里端到端语音识别工具包

F5-TTS 零样本语音

⭐ 15k+ GitHub Stars

零样本声音克隆文本转语音系统

LiveKit 实时语音体

⭐ 13k+ GitHub Stars

构建实时语音和视频 AI 智能体的框架

Piper 快速 TTS

⭐ 11k+ GitHub Stars

快速本地神经网络文本转语音系统

Demucs 音频分离

⭐ 10k+ GitHub Stars

分离人声/鼓/贝斯/吉他的音频源分离工具

VALL-E X 跨语言 TTS

⭐ 7.9k+ GitHub Stars

跨语言神经编解码语音生成模型

Whisper Web 界面

⭐ 2k+ GitHub Stars

基于 Gradio 的 Whisper 语音转写 Web 界面

AI 语音与配音工具:20 个开源声音项目:常见问题

免费 AI 配音工具有哪些?

ChatTTS 与 F5-TTS 是目前口碑最好的开源中文配音模型,音色自然可克隆;bark 支持多语种与音乐。配合本页其他工具可做完整语音流水线。

浏览全部 300+ 开源 AI 工具