Skip to main content
POST
Synthèse vocale asynchrone MiniMax Speech-2.6-hd
Cette API prend en charge la génération asynchrone de synthèse vocale à partir de texte. Une génération de texte unique prend en charge jusqu’à 1 million de caractères pour la transmission, et le résultat audio complet généré peut être récupéré de manière asynchrone. Elle prend en charge plus de 100 voix système et des voix clonées au choix ; elle permet également d’ajuster librement l’intonation, la vitesse, le volume, le débit binaire, la fréquence d’échantillonnage et le format de sortie. Après avoir soumis une demande de synthèse vocale pour un texte long, veuillez noter que l’URL retournée est valable 24 heures à partir de son retour. Veillez à télécharger les informations à temps.
Convient à la génération vocale de textes longs, comme des livres entiers. Le temps d’attente dans la file de tâches peut être relativement long. Pour les phrases courtes, le chat vocal, les interactions sociales en ligne et les scénarios similaires, il est recommandé d’utiliser l’appel synchrone de synthèse vocale.

En-têtes de requête

string
requis
Valeur d’énumération : application/json
string
requis
Format d’authentification Bearer : Bearer {{API Key}}.

Corps de la requête

string
requis
Texte à synthétiser, limité à un maximum de 50 000 caractères.
object
requis
object
object
string
défaut:"null"
Renforce la capacité de reconnaissance des langues minoritaires et dialectes spécifiés. Une fois défini, ce paramètre peut améliorer les performances vocales dans les scénarios de langue minoritaire/dialecte spécifiés. Si le type de langue minoritaire n’est pas clair, vous pouvez choisir “auto” ; le modèle déterminera alors automatiquement le type de langue minoritaire. Les valeurs prises en charge sont les suivantes :'Chinese', 'Chinese,Yue', 'English', 'Arabic', 'Russian', 'Spanish', 'French', 'Portuguese', 'German', 'Turkish', 'Dutch', 'Ukrainian', 'Vietnamese', 'Indonesian', 'Japanese', 'Italian', 'Korean', 'Thai', 'Polish', 'Romanian', 'Greek', 'Czech', 'Finnish', 'Hindi', 'Bulgarian', 'Danish', 'Hebrew', 'Malay', 'Persian', 'Slovak', 'Swedish', 'Croatian', 'Filipino', 'Hungarian', 'Norwegian', 'Slovenian', 'Catalan', 'Nynorsk', 'Tamil', 'Afrikaans', 'auto'
object
Paramètres d’effets vocaux. Formats audio pris en charge par ce paramètre : mp3, wav, flac

Paramètres de réponse

string
requis
Le task_id de la tâche asynchrone. Vous devez utiliser ce task_id pour appeler l’API de consultation du résultat de tâche afin d’obtenir le résultat généré.