CV声音克隆工具
clone-voice
3/5
🧩 软硬件结合
已发布
项目简介
A sound cloning tool with a web interface, using your voice or any sound to record audio / 一个带web界面的声音克隆工具,使用你的音色或任意声音来录
A sound cloning tool with a web interface, using your voice or any sound to record audio / 一个带web界面的
标签
项目特点
**声音克隆**:使用任何人类音色,将文字合成为语音,或将一个声音转换为另一个声音。
**Web界面**:提供直观的Web操作界面,鼠标点击即可完成操作。
**多语言支持**:支持中、英、日、韩、法、德、意等16种语言。
**在线录音**:支持从麦克风在线录制声音作为音色样本。
**无需GPU**:没有NVIDIA GPU也能正常使用。
**预编译版本**:提供Windows预编译版,下载解压即可运行,无需配置环境。
**CUDA加速**:如果拥有NVIDIA GPU并正确配置CUDA环境,可自动启用加速。
技术规格
| 模型 | [coqui.ai](https://coqui.ai/) 出品的 xtts_v2 |
|---|---|
| 模型协议 | [Coqui Public Model License 1.0.0](https://coqui.ai/cpml.txt) |
| 支持语言 | 中、英、日、韩、法、德、意等16种语言 |
| 推荐录音时长 | 5秒到20秒 |
| 录音要求 | 发音清晰准确,无背景噪声 |
| 输入音频格式 | mp3/wav/flac |
| 运行环境 | Windows (预编译版),Linux/macOS (源码部署) |
| Python版本 | 3.9 - 3.11 |
| 默认端口 | 9988 |
项目资源
搜索资源
物料清单 (BOM)
| 物料名称 | 数量 | 参考价格 | 备注 |
|---|---|---|---|
| 预编译版主文件 | 1 | — | 约1.7G,从Releases下载 |
| 模型文件 | 1 | — | 约3G,从Releases下载,解压到 `tts` 文件夹 |
| ffmpeg | 1 | — | 源码部署时需要,从ffmpeg官网下载 |
| NVIDIA GPU (可选) | 1 | — | 用于CUDA加速 |
所需工具
| 工具 | 用途 | 是否必需 |
|---|---|---|
| ▢ 推荐 | ||
| ▢ 推荐 | ||
| ▢ 推荐 | ||
| ▢ 推荐 | ||
| ▢ 推荐 | ||
| ▢ 推荐 |
视频
所需技能
🔧 **动手能力**:能够下载并解压文件,运行可执行程序,配置环境变量(源码部署时需要)。
💻 **编程能力**:源码部署需要熟悉Python虚拟环境、pip安装依赖、命令行操作。
⚡ **电子电路**:无需。
适用场景
**内容创作**:为视频、播客、有声书等生成特定音色的配音。
**语音助手**:为智能设备或应用定制个性化的语音交互。
**辅助工具**:帮助语言障碍者或需要特定声音表达的用户。
**娱乐与创意**:模仿名人声音进行趣味创作,或为游戏角色配音。