Skip to main content
POST
Synthèse vocale synchrone MiniMax Speech 2.8 HD
Convertit du texte en parole, avec prise en charge de plusieurs voix, du contrôle des émotions, du réglage de la vitesse d’élocution, etc. La longueur du texte doit être inférieure à 10000 caractères. Si le texte dépasse 3000 caractères, il est recommandé d’utiliser une sortie en streaming.

En-têtes de requête

string
requis
Valeur énumérée : application/json
string
requis
Format d’authentification Bearer : Bearer {{API Key}}.

Corps de la requête

string
requis
Texte à synthétiser en parole. La longueur doit être inférieure à 10000 caractères. Si le texte dépasse 3000 caractères, il est recommandé d’utiliser une sortie en streaming. Prend en charge les changements de paragraphe (sauts de ligne), le contrôle des pauses (marqueur <#x#>) et les balises d’interjections (comme (laughs), (coughs), etc., uniquement prises en charge par speech-2.8-hd/turbo)
boolean
défaut:false
Contrôle si la sortie est en streaming. Par défaut : false, c’est-à-dire sans streaming
object
object
string
défaut:"hex"
Paramètre contrôlant le format du résultat de sortie. Valeurs disponibles : url, hex ; valeur par défaut : hex. Ce paramètre ne prend effet que dans les scénarios non streaming. Les scénarios streaming ne prennent en charge que le retour au format hex. L’url retournée est valide pendant 24 heuresValeurs disponibles : url, hex
object
boolean
défaut:false
Contrôle l’ajout d’un identifiant rythmique audio à la fin de l’audio synthétisé. Valeur par défaut : false. Ce paramètre ne prend effet que pour la synthèse non streaming
string
Indique s’il faut renforcer la capacité de reconnaissance des langues moins répandues et des dialectes spécifiés. Valeur par défaut : null ; peut être défini sur auto pour laisser le modèle déterminer automatiquementValeurs disponibles : Chinese, Chinese,Yue, English, Arabic, Russian, Spanish, French, Portuguese, German, Turkish, Dutch, Ukrainian, Vietnamese, Indonesian, Japanese, Italian, Korean, Thai, Polish, Romanian, Greek, Czech, Finnish, Hindi, Bulgarian, Danish, Hebrew, Malay, Persian, Slovak, Swedish, Croatian, Filipino, Hungarian, Norwegian, Slovenian, Catalan, Nynorsk, Tamil, Afrikaans, auto
object
object[]
Paramètres de voix mixte, avec un maximum de 4 voix mélangées
boolean
défaut:false
Contrôle l’activation du service de sous-titres. Valeur par défaut : false. Ce paramètre n’est valide que dans les scénarios de sortie non streaming et uniquement pour les modèles speech-2.6-hd, speech-2.6-turbo, speech-01-turbo, speech-01-hd
boolean
défaut:false
Activez ce paramètre pour rendre les transitions entre propositions plus naturelles. Ne prend en charge que les modèles speech-2.8-hd et speech-2.8-turbo
object

Informations de réponse

object
Objet de données de synthèse retourné, pouvant être null ; une vérification non nulle est requise
string
id de cette session, utilisé pour aider à localiser le problème lors d’une demande d’assistance ou d’un retour
object
Code d’état et détails de cette requête
object
Informations supplémentaires de l’audio