Voice-pro
Voice-Pro is a Windows web application for multilingual speech recognition, voice cloning, translation, dubbing, and text-to-speech production.

Total stars
Last 7 days
12,362
HostingSelf-hostable
LicenseGPL-3.0
LanguagePython
Last commitJul 13, 2026
Latest releaseJul 13, 2026
Release frequency5.4 per year
Contributors1
Stars12,362
Forks1,789
Issues58
What it does
Voice-Pro is an open-source AI multimedia web application for creators, researchers, and multilingual professionals. Its workflows combine YouTube downloading and audio extraction, vocal separation, speech recognition, translation, subtitle generation, voice cloning, and text-to-speech in a Dubbing Studio. It supports Whisper variants, F5-TTS, E2-TTS, CosyVoice, kokoro, and Edge-TTS, with multilingual processing and configurable speech output.
The Gradio WebUI includes Dubbing Studio, Whisper Caption, Translate, and Speech Generation tabs. Users can process common media formats, export WAV, FLAC, or MP3 audio, create subtitles, translate subtitle files, and perform real-time voice recognition and translation. The repository describes Windows support, especially with an NVIDIA GPU, and provides a portable installer using start.bat; Mac and Linux operation is unverified.
Capabilities
#Text-to-speech voiceover production
#Voice cloning and design
#Speech transcription
#Multilingual dubbing
Built with
Tools similar to Voice-pro
GPT-SoVITS
Audio Editing
ChatTTS
Audio Editing
Ebook2audiobook
Audio Editing
VoiceStudio
Audio Editing
EmotiVoice
Audio Editing
Abogen
Audio Editing