VoiceStudio
VoiceStudio is an open-source desktop voice AI studio for local text-to-speech, voice cloning, multilingual dubbing, dictation, transcription, and audiobooks.

Total stars
Last 7 days
9,971
HostingSelf-hostable
LicenseAGPL-3.0
LanguagePython
Last commitAug 15, 2026
Latest releaseAug 14, 2026
Release frequency8.5 per month
Contributors33
Stars9,971
Forks1,655
Issues10
What it does
VoiceStudio is an open-source desktop application for generating and working with synthetic speech locally. Its documented workflows include text-to-speech, zero-shot voice cloning, voice design, dictation, transcription, video dubbing, audiobook creation from EPUB or PDF files, and multi-voice stories. It supports multiple TTS and ASR engines, batch queues, speaker diarization, vocal isolation, watermarking, and GPU-aware engine routing.
The application is designed for user-controlled deployment on macOS, Windows, and Linux, with downloadable DMG, MSI, and AppImage releases plus Docker installation guidance. Processing runs on the user’s machine without accounts, API keys, or cloud dependence, while a remote-backend option is also documented. The project is licensed AGPL-3.0 and exposes an OpenAI-compatible API and MCP server.
Capabilities
#Text-to-speech voiceover production
#Voice cloning and design
#Speech transcription
#Multilingual dubbing
#Audio and agent APIs
Built with
Tools similar to VoiceStudio
GPT-SoVITS
Audio Editing
ChatTTS
Audio Editing
Ebook2audiobook
Audio Editing
Voice-pro
Audio Editing
EmotiVoice
Audio Editing
Abogen
Audio Editing