ElevenLabs texto a voz V3
Audio
ElevenLabs texto a voz V3
POST
ElevenLabs texto a voz V3
Convierte texto en voz usando la voz que elija y devuelve el audio.
Encabezados de solicitud
Valores enumerados:
application/jsonFormato de autenticación Bearer: Bearer {{API Key}}.
Cuerpo de la solicitud
Si se especifica, el sistema intentará muestrear de forma determinista. Las solicitudes repetidas con el mismo seed y los mismos parámetros deberían devolver el mismo resultado, pero no se garantiza una determinación completa.Rango de valores: [0, 4294967295]
El texto que se convertirá en voz.
Si se debe habilitar el modo Stream.
El ID de la voz que se utilizará.
Código de idioma (ISO 639-1) utilizado para el modelo y la normalización del texto. Si el modelo no admite este código de idioma, se devolverá un error.
Formato de salida del audio generado. El formato es codec_sample_rate_bitrate. La tasa de bits de 192 kbps para MP3 requiere una cuenta Creator o superior; la frecuencia de muestreo de 44,1 kHz para PCM requiere una cuenta Pro o superior.Valores opcionales:
mp3_22050_32, mp3_24000_48, mp3_44100_32, mp3_44100_64, mp3_44100_96, mp3_44100_128, mp3_44100_192, pcm_8000, pcm_16000, pcm_22050, pcm_24000, pcm_32000, pcm_44100, pcm_48000, ulaw_8000, alaw_8000, opus_48000_32, opus_48000_64, opus_48000_96, opus_48000_128, opus_48000_192Si es true, usa la versión IVC de la voz en lugar de la versión PVC. Esta es una solución temporal para la mayor latencia de la versión PVC.
Controla la normalización del texto. ‘auto’ permite que el sistema decida, ‘on’ siempre normaliza y ‘off’ la omite.Valores opcionales:
auto, on, offControla la normalización de texto específica del idioma para algunos idiomas compatibles con el fin de lograr una pronunciación más natural. Advertencia: puede aumentar significativamente la latencia. Actualmente solo se admite japonés.
Lista de localizadores de diccionarios de pronunciación (id, version_id) que deben aplicarse al texto. Se aplican en orden. Cada solicitud puede tener como máximo 3 localizadores.Longitud del arreglo: 0 - 3
Información de respuesta
Archivo de audio generado Formato:binary