v50

latestOpenAPI 3.0.1MITraw.githubusercontent.com2026-06-15222761.9 KB

Create a voice from audio

Creates a custom voice by cloning from an audio file.

post/voices

Request body

namestring required

Name of the voice

audioUrlstring uri required

HTTPS URL to the audio file for voice cloning (MP3, WAV, M4A). Duration must be between 30 seconds and 4 minutes.

modelId'eleven_multilingual_v2' | 'eleven_multilingual_v1' | 'eleven_monolingual_v1' | 'eleven_turbo_v2' | 'eleven_turbo_v2_5' | 'eleven_flash_v2_5' | 'eleven_v3' | 'speech-02-hd' | 'speech-02-turbo' | 'speech-2.5-hd-preview' | 'speech-2.5-turbo-preview' | 'speech-2.6-hd' | 'speech-2.6-turbo' | 'speech-2.8-hd' | 'speech-2.8-turbo'

Voice model to use for TTS. Determines which provider (ElevenLabs or Minimax) and which settings are available.

language'ENGLISH' | 'SPANISH' | 'FRENCH' | 'PORTUGUESE' | 'GERMAN' | 'RUSSIAN' | 'HINDI' | 'CHINESE' | 'DUTCH' | 'ARABIC' | 'POLISH' | 'BULGARIAN' | 'JAPANESE' | 'ITALIAN'
gender'MALE' | 'FEMALE'

Response

Voice created successfully

idstring uuid
namestring
createdAtstring date-time
updatedAtstring date-time
statusstring
sampleUrlstring
language'ENGLISH' | 'SPANISH' | 'FRENCH' | 'PORTUGUESE' | 'GERMAN' | 'RUSSIAN' | 'HINDI' | 'CHINESE' | 'DUTCH' | 'ARABIC' | 'POLISH' | 'BULGARIAN' | 'JAPANESE' | 'ITALIAN' nullable
gender'MALE' | 'FEMALE' nullable