CV声音克隆工具 clone-voice

3/5 🧩 软硬件结合 已发布
jianchang512 3944 Stars 未知 BOM 完整度: 0/5 教程完整度: 0/5
CV声音克隆工具

项目简介

A sound cloning tool with a web interface, using your voice or any sound to record audio / 一个带web界面的声音克隆工具,使用你的音色或任意声音来录


A sound cloning tool with a web interface, using your voice or any sound to record audio / 一个带web界面的

标签

项目特点

**声音克隆**:使用任何人类音色,将文字合成为语音,或将一个声音转换为另一个声音。
**Web界面**:提供直观的Web操作界面,鼠标点击即可完成操作。
**多语言支持**:支持中、英、日、韩、法、德、意等16种语言。
**在线录音**:支持从麦克风在线录制声音作为音色样本。
**无需GPU**:没有NVIDIA GPU也能正常使用。
**预编译版本**:提供Windows预编译版,下载解压即可运行,无需配置环境。
**CUDA加速**:如果拥有NVIDIA GPU并正确配置CUDA环境,可自动启用加速。

技术规格

模型 [coqui.ai](https://coqui.ai/) 出品的 xtts_v2
模型协议 [Coqui Public Model License 1.0.0](https://coqui.ai/cpml.txt)
支持语言 中、英、日、韩、法、德、意等16种语言
推荐录音时长 5秒到20秒
录音要求 发音清晰准确,无背景噪声
输入音频格式 mp3/wav/flac
运行环境 Windows (预编译版),Linux/macOS (源码部署)
Python版本 3.9 - 3.11
默认端口 9988

项目资源

物料清单 (BOM)

物料名称 数量 参考价格 备注
预编译版主文件 1 约1.7G,从Releases下载
模型文件 1 约3G,从Releases下载,解压到 `tts` 文件夹
ffmpeg 1 源码部署时需要,从ffmpeg官网下载
NVIDIA GPU (可选) 1 用于CUDA加速

所需工具

工具用途是否必需
▢ 推荐
▢ 推荐
▢ 推荐
▢ 推荐
▢ 推荐
▢ 推荐

视频

所需技能

🔧 **动手能力**:能够下载并解压文件,运行可执行程序,配置环境变量(源码部署时需要)。 💻 **编程能力**:源码部署需要熟悉Python虚拟环境、pip安装依赖、命令行操作。 ⚡ **电子电路**:无需。

适用场景

**内容创作**:为视频、播客、有声书等生成特定音色的配音。
**语音助手**:为智能设备或应用定制个性化的语音交互。
**辅助工具**:帮助语言障碍者或需要特定声音表达的用户。
**娱乐与创意**:模仿名人声音进行趣味创作,或为游戏角色配音。