Skip to main content
POST
Síntesis de voz asíncrona MiniMax Speech-2.6-hd
Esta API admite la generación asíncrona de texto a voz. La transmisión de generación de texto en una sola vez admite hasta 1 millón de caracteres, y el resultado de audio completo generado se puede recuperar de forma asíncrona. Admite más de 100 voces del sistema y voces clonadas seleccionables libremente; también permite ajustar de forma independiente la entonación, la velocidad, el volumen, la tasa de bits, la frecuencia de muestreo y el formato de salida. Después de enviar una solicitud de síntesis de voz para texto largo, tenga en cuenta que la URL devuelta tiene una validez de 24 horas desde el momento en que se devuelve la URL. Preste atención al tiempo disponible para descargar la información.
Es adecuado para la generación de voz de textos largos, como libros completos; el tiempo de espera en cola de la tarea puede ser prolongado. Para escenarios como generación de frases cortas, chat de voz y socialización en línea, se recomienda usar la síntesis de voz mediante llamada síncrona.

Encabezados de solicitud

string
requerido
Valores enumerados: application/json
string
requerido
Formato de autenticación Bearer: Bearer {{API Key}}.

Cuerpo de la solicitud

string
requerido
Texto que se va a sintetizar, con un límite máximo de 50 000 caracteres.
object
requerido
object
object
string
predeterminado:"null"
Mejora la capacidad de reconocimiento de idiomas minoritarios y dialectos especificados. Una vez configurado, puede mejorar el rendimiento de voz en escenarios del idioma minoritario/dialecto especificado. Si no está claro el tipo de idioma minoritario, se puede seleccionar “auto” y el modelo determinará de forma autónoma el tipo de idioma minoritario. Admite los siguientes valores:'Chinese', 'Chinese,Yue', 'English', 'Arabic', 'Russian', 'Spanish', 'French', 'Portuguese', 'German', 'Turkish', 'Dutch', 'Ukrainian', 'Vietnamese', 'Indonesian', 'Japanese', 'Italian', 'Korean', 'Thai', 'Polish', 'Romanian', 'Greek', 'Czech', 'Finnish', 'Hindi', 'Bulgarian', 'Danish', 'Hebrew', 'Malay', 'Persian', 'Slovak', 'Swedish', 'Croatian', 'Filipino', 'Hungarian', 'Norwegian', 'Slovenian', 'Catalan', 'Nynorsk', 'Tamil', 'Afrikaans', 'auto'
object
Configuración del efecto de voz. Formatos de audio admitidos por este parámetro: mp3, wav, flac

Parámetros de información de respuesta

string
requerido
El task_id de la tarea asíncrona. Debe usar este task_id para solicitar la API de consulta del resultado de la tarea y obtener el resultado generado.