AI 语音
Whisper 语音识别
⭐ 107k+ GitHub Stars
OpenAI 开源语音识别模型
GPT-SoVITS 声音克隆
⭐ 61k+ GitHub Stars
强大的少样本声音克隆与 TTS 工具
Whisper.cpp 高效识别
⭐ 53k+ GitHub Stars
OpenAI Whisper 的 C/C++ 高速本地推理实现
Coqui 深度学习 TTS
⭐ 46k+ GitHub Stars
深度学习文本转语音工具集
ChatTTS 对话语音
⭐ 40k+ GitHub Stars
细粒度对话场景文本转语音模型
Bark 语音生成
⭐ 39k+ GitHub Stars
支持情感和音乐的文本转语音生成模型
RVC 声线转换
⭐ 38k+ GitHub Stars
基于检索的实时声线转换 Web 界面
OpenVoice 声音克隆
⭐ 37k+ GitHub Stars
MyShell 出品的即时声音克隆工具
Fish Speech TTS
⭐ 32k+ GitHub Stars
支持声音克隆的新一代 TTS 解决方案
so-vits-svc 歌声转换
⭐ 28k+ GitHub Stars
基于 VITS 和 SoftVC 的歌声转换模型
Faster Whisper 加速识别
⭐ 25k+ GitHub Stars
基于 CTranslate2 的 4 倍加速 Whisper 实现
WhisperX 带对齐识别
⭐ 24k+ GitHub Stars
带词级时间戳和说话人分离的 Whisper
AudioCraft 音频生成
⭐ 24k+ GitHub Stars
Meta 开源的音频与音乐生成库
FunASR 语音识别框架
⭐ 20k+ GitHub Stars
阿里端到端语音识别工具包
F5-TTS 零样本语音
⭐ 15k+ GitHub Stars
零样本声音克隆文本转语音系统
LiveKit 实时语音体
⭐ 13k+ GitHub Stars
构建实时语音和视频 AI 智能体的框架
Piper 快速 TTS
⭐ 11k+ GitHub Stars
快速本地神经网络文本转语音系统
Demucs 音频分离
⭐ 10k+ GitHub Stars
分离人声/鼓/贝斯/吉他的音频源分离工具
VALL-E X 跨语言 TTS
⭐ 7.9k+ GitHub Stars
跨语言神经编解码语音生成模型
Whisper Web 界面
⭐ 2k+ GitHub Stars
基于 Gradio 的 Whisper 语音转写 Web 界面
AI 语音与配音工具:20 个开源声音项目:常见问题
免费 AI 配音工具有哪些?
ChatTTS 与 F5-TTS 是目前口碑最好的开源中文配音模型,音色自然可克隆;bark 支持多语种与音乐。配合本页其他工具可做完整语音流水线。