语音克隆与合成工作台
来源:github.com — abus-aikorea/voice-pro · ⭐ 53
📋 概述
voice-pro 是一个基于 Gradio WebUI 的语音创作与开发工具,集成 Edge-TTS、kokoro 等主流 TTS 引擎,以及 E2、F5-TTS、CosyVoice 等零样本语音克隆方案。它还内置 Whisper 音频处理、YouTube 下载、Demucs 人声分离与多语言翻译等功能,面向内容创作者与开发者提供一站式的语音处理能力。
🔑 核心要点
- 集成多引擎 TTS 与零样本语音克隆,Edge-TTS / kokoro / E2 / F5-TTS / CosyVoice。
- 内置 Whisper 音频处理,识别、转写、翻译一体化。
- 支持 YouTube 下载与人声分离,用 Demucs 分离人声与伴奏。
- Gradio WebUI 图形界面,创作者与开发者均可零门槛上手。
💡 金句
一个图形界面,把合成、克隆、分离与翻译的语音创作全流程打通。
👍 0
👎 0
← 返回 GitHub Trending 首页