AI 音频

GPT-SoVITS

一分钟语音即可克隆的 TTS 模型

免费开源支持中文

GPT-SoVITS 是一款少样本语音克隆加多语言 TTS 的开源模型,只需一分钟左右的语音数据即可训练出高质量的语音克隆模型。它对中文效果尤其出色,支持多语言与多种音色,是做 AI 配音、有声内容生产时最常用的开源语音方案之一。工具完全开源,源代码公开,可自由部署与二次开发,团队能根据自身需求深度定制,无需向第三方厂商支付授权费用,长期使用成本极低。项目社区活跃,文档齐全,迭代频繁,遇到问题通常能在官方仓库或社区找到现成解答,学习与维护的门槛都比较低。