← Back to all categories

Voice & Audio

Create speech, music, voiceovers, and edited audio.

21curated tools
Freemium

Voice & Audio

ElevenLabs

A natural-sounding voice platform for speech, dubbing, and audio creation.

#Text to speech#Voiceover#Dubbing
View details
Freemium

Voice & Audio

Suno

Generate complete songs and musical ideas from a simple description.

#Music generation#Songs#Creative
View details
Freemium

Voice & Audio

Descript

Edit audio and video as easily as editing a text document.

#Audio editing#Transcription#Podcasting
View details
Freemium

Voice & Audio

Murf

An AI voice platform for producing voiceovers, presentations, training audio, and localized content.

#Voiceover#Text to speech#Localization
View details
Freemium

Voice & Audio

Speechify

A text-to-speech platform that reads documents, webpages, books, and other written content aloud.

#Text to speech#Reading#Accessibility
View details
Freemium

Voice & Audio

Udio

An AI music creation platform for generating songs, extending tracks, and exploring musical ideas.

#Music generation#Songs#Audio
View details
Freemium

Voice & Audio

AIVA

An AI music composer for creating soundtracks and instrumental pieces across multiple styles.

#Music composition#Soundtracks#Instrumental
View details
Freemium

Voice & Audio

Krisp

An AI audio assistant for removing noise, transcribing calls, and improving online meetings.

#Noise cancellation#Meetings#Transcription
View details
Freemium

Voice & Audio

Adobe Podcast

A browser-based AI audio toolkit for enhancing speech, recording, transcription, and podcast production.

#Speech enhancement#Podcasting#Adobe
View details
Freemium

Voice & Audio

Resemble AI

A production voice platform for generating, cloning, localizing, and protecting synthetic speech across applications and media.

#Voice cloning#Text to speech#Voice security
View details
Paid

Voice & Audio

WellSaid

A business-focused AI voice platform for producing natural voiceovers with licensed voices, collaboration tools, and API access.

#Voiceover#Text to speech#Enterprise
View details
Paid

Voice & Audio

SOUNDRAW

An AI music generator for creating and customizing original tracks with licensing options for content, artists, teams, and applications.

#Music generation#Royalty free#Soundtracks
View details
Freemium

Voice & Audio

Moises

An AI-powered music workspace for separating stems, generating instrument parts, detecting chords, changing pitch, and practicing songs.

#Stem separation#Music practice#AI studio
View details
Freemium

Voice & Audio

LALAL.AI

An AI audio processing suite for separating vocals and instruments, cleaning voice recordings, and preparing editable stems from media files.

#Stem splitter#Vocal remover#Audio cleanup
View details
Freemium

Voice & Audio

Hume AI

A voice AI platform for emotionally intelligent speech-to-speech agents, text-to-speech, and custom voices.

#Voice agents#Speech to speech#Emotional AI
View details
Open source

Voice & Audio

ACE-Step 1.5

An open-source music generation foundation model that creates complete songs from text, lyrics, and reference audio while running locally across consumer hardware.

#Music generation#Local AI#Audio editing
View details
Open source

Voice & Audio

Fish Speech

A self-hostable open-source text-to-speech system for multilingual, expressive speech generation and rapid voice cloning through local inference or an HTTP API.

#Text to speech#Voice cloning#Self hosted
View details
Open source

Voice & Audio

Piper

A fast local neural text-to-speech engine with downloadable voices, command-line and web interfaces, and Python, HTTP, and C++ integration options.

#Text to speech#Offline#Developer tools
View details
Open source

Voice & Audio

Qwen3-TTS

An open-source speech generation model family for expressive multilingual text to speech, natural-language voice design, streaming output, and rapid voice cloning.

#Speech generation#Voice design#Streaming TTS
View details
Open source

Voice & Audio

VibeVoice

Microsoft's open-source voice AI family for structured long-form speech recognition and lightweight real-time speech generation, with speaker, timestamp, and contextual transcription support.

#Speech recognition#Streaming TTS#Long-form audio
View details
Open source

Voice & Audio

Dograh

An open-source, self-hostable platform for building production voice agents with visual workflows, telephony, observability, and swappable speech and language models.

#Voice agents#Self hosted#Open source
View details